{"as_of":"2026-08-09T03:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e46048495c94e18626c986175a97bbdc15654d6b8c192fd7f0b21f6983e65f5","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:42:56.200787Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.18181/citation-record","integrity":"/paper/2507.18181/integrity","json":"/paper/2507.18181/citation-record.json","paper":"/paper/2507.18181"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T14:42:55.990819Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:55.990819Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:21f66fa05e44ebe5055760b47777e3fd3516e1af411954fa5b8d58220cdcb697","observation_id":"de92f81f-faf7-44ac-90ec-95207624deb4","resolution":{"observed_at":"2026-08-06T14:42:55.990819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T14:42:55.998668Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:55.998668Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:549fa8607183d129ed8abd208bcfd325346fe07564053de4d6720a1e7ddc8e70","observation_id":"2e04d542-8800-423e-bdfc-69de61ad0d76","resolution":{"observed_at":"2026-08-06T14:42:55.998668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.903659Z","title":"Toolqa: A dataset for llm question answering with external tools,","venue":null,"work_id":"cb52c931-2395-454c-8bd5-501637c99b7e","year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.004793Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:a8372439a37b2341089bd3d93c0dc18afce16fafcc497fa33b7f432a2c418617","observation_id":"01e6fea3-b51b-4b12-930c-720a8b173426","resolution":{"observed_at":"2026-08-06T14:42:56.909740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-06T14:42:56.011964Z","title":"Rt-2: Vision-language- action models transfer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.011964Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:5dad63699cec2885c085faf3078fd766840113212f8a0c3a21a3ba386d580c8b","observation_id":"1c4b2c8a-fd7c-4f30-8c15-462075c4fce3","resolution":{"observed_at":"2026-08-06T14:42:56.011964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.880758Z","title":"On decoder-only architecture for speech-to-text and large language model integration,","venue":null,"work_id":"7becb6c9-a4e1-414e-950a-83b149f0f0e0","year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.020418Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:b7d637071dea6dd83bc72fab36c1ae6d04c9e4074cabc2daef5e990dfcef2a29","observation_id":"bc724691-917e-4c1d-8afa-cf06cafa5ba3","resolution":{"observed_at":"2026-08-06T14:42:56.886571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09569","last_updated":"2024-06-13T20:20:29Z","snapshot_observed_at":"2026-08-03T20:22:45.687875Z","submitted_at":"2024-06-13T20:20:29Z","title":"Speech ReaLLM -- Real-time Streaming Speech Recognition with Multimodal LLMs by Teaching the Flow of Time","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09569","snapshot_observed_at":"2026-08-06T14:42:56.029693Z","title":"Speech reallm– real-time streaming speech recognition with multimodal llms by teaching the flow of time,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.029693Z"},"links":{"cited_paper":"/paper/2406.09569","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:3d10701b3b9e1d6ce57c74e7cc0d01c407e2826500d734d143ed56ae765f48f7","observation_id":"21734548-2019-4bc3-8084-296e92507613","resolution":{"observed_at":"2026-08-06T14:42:56.029693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04675","last_updated":"2024-07-10T09:01:17Z","snapshot_observed_at":"2026-07-06T18:42:05.670928Z","submitted_at":"2024-07-05T17:38:03Z","title":"Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04675","snapshot_observed_at":"2026-08-06T14:42:56.037314Z","title":"Seed-asr: Understanding diverse speech and contexts with llm-based speech recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.037314Z"},"links":{"cited_paper":"/paper/2407.04675","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:41f11fbc7c1071f74bd8752ed31107c42b216bae87d4c4b38e7a173bacdd5bea","observation_id":"b80dc020-9196-44e7-8b93-c1503b356253","resolution":{"observed_at":"2026-08-06T14:42:56.037314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06666","last_updated":"2025-03-01T12:59:49Z","snapshot_observed_at":"2026-07-06T19:13:20.458958Z","submitted_at":"2024-09-10T17:34:34Z","title":"LLaMA-Omni: Seamless Speech Interaction with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06666","snapshot_observed_at":"2026-08-06T14:42:56.043822Z","title":"Llama-omni: Seamless speech interaction with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.043822Z"},"links":{"cited_paper":"/paper/2409.06666","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:9972c4bd5a87c0f8198ff04a8361da7814af208b82993e7e1c170efec382edec","observation_id":"65f20b7f-5213-4063-be88-bbe4978d02b0","resolution":{"observed_at":"2026-08-06T14:42:56.043822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.050084Z","title":"Prompting large language models with speech recognition abilities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.050084Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:52dc4e07decdd38a444dff7be6a31ffc7cb761b5b479608c84f283161e2d6270","observation_id":"e729f6ac-1491-41e4-a5c7-18a9eca2124d","resolution":{"observed_at":"2026-08-06T14:42:56.050084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19954","last_updated":"2024-06-28T14:40:03Z","snapshot_observed_at":"2026-07-06T18:38:29.579641Z","submitted_at":"2024-06-28T14:40:03Z","title":"BESTOW: Efficient and Streamable Speech Language Model with the Best of Two Worlds in GPT and T5","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19954","snapshot_observed_at":"2026-08-06T14:42:56.055144Z","title":"Bestow: Efficient and streamable speech language model with the best of two worlds in gpt and t5,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.055144Z"},"links":{"cited_paper":"/paper/2406.19954","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:2b12d493647cd31aa35cc977142eb86d3fdd996277229d62e5fa2b99416ddc28","observation_id":"daa9695a-152c-4faf-8abb-2599c78ae90b","resolution":{"observed_at":"2026-08-06T14:42:56.055144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-06T14:42:56.060549Z","title":"Accelerating large language model decoding with speculative sam- pling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.060549Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:9d133bb806010a7beb13588bcb809f5f40ed5947288c5e4144ee292b4dda1665","observation_id":"fbf8372b-7af9-4290-8c7a-f53c317d8c70","resolution":{"observed_at":"2026-08-06T14:42:56.060549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.850282Z","title":"Fast inference from transform- ers via speculative decoding,","venue":null,"work_id":"d384e35a-8468-483b-8a9e-45865cf1603a","year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.066142Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:4c88e16164fc573c52e66418d512170c3bc8de7e086c90118c11b44a7bb0fd3e","observation_id":"fdc72fae-8afb-4ddc-85bb-e7e56106503a","resolution":{"observed_at":"2026-08-06T14:42:56.854937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09781","last_updated":"2024-04-01T02:18:42Z","snapshot_observed_at":"2026-07-06T15:28:24.682211Z","submitted_at":"2023-05-16T20:12:59Z","title":"SpecInfer: Accelerating Generative Large Language Model Serving with Tree-based Speculative Inference and Verification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09781","snapshot_observed_at":"2026-08-06T14:42:56.072232Z","title":"Specinfer: Accelerating generative large language model serving with tree-based speculative inference and verification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.072232Z"},"links":{"cited_paper":"/paper/2305.09781","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:46fcc4c9ce28cd9bfb5818dbe313f3d3595468e335f1f0bc05599e60ca5622e1","observation_id":"24d2f468-67f1-4805-841e-a7bdb2402af4","resolution":{"observed_at":"2026-08-06T14:42:56.072232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-06T14:42:56.078104Z","title":"Medusa: Simple llm inference acceleration framework with multiple decoding heads,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.078104Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:66c63b364a6023b1250e2a0f7936eae41fb7815d4ea49b644def1f3ff9d93b86","observation_id":"08d9a2c0-da64-4c02-ad38-d3f62d74b9d7","resolution":{"observed_at":"2026-08-06T14:42:56.078104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15077","last_updated":"2025-03-04T13:58:39Z","snapshot_observed_at":"2026-08-03T09:40:31.365295Z","submitted_at":"2024-01-26T18:59:01Z","title":"EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15077","snapshot_observed_at":"2026-08-06T14:42:56.083727Z","title":"Eagle: Speculative sampling re- quires rethinking feature uncertainty,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.083727Z"},"links":{"cited_paper":"/paper/2401.15077","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:f3b7a6b37e27c293022a92088847c438629a869f39e771ff4c6296b5385f659c","observation_id":"88326143-65d3-4c93-a2f4-f6479bdf695e","resolution":{"observed_at":"2026-08-06T14:42:56.083727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11744","last_updated":"2024-10-15T16:21:15Z","snapshot_observed_at":"2026-07-06T19:33:57.090585Z","submitted_at":"2024-10-15T16:21:15Z","title":"DySpec: Faster Speculative Decoding with Dynamic Token Tree Structure","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11744","snapshot_observed_at":"2026-08-06T14:42:56.088831Z","title":"Dyspec: Faster speculative decoding with dynamic token tree structure,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.088831Z"},"links":{"cited_paper":"/paper/2410.11744","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:02a55cd81b424dc6baae64d892be887d2e2a96a4ef4108d6ef9f6b9d36d9f17f","observation_id":"b1f4f612-a7f2-423b-97f4-69f78366719e","resolution":{"observed_at":"2026-08-06T14:42:56.088831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15869","last_updated":"2024-09-24T08:42:31Z","snapshot_observed_at":"2026-07-06T19:21:03.775247Z","submitted_at":"2024-09-24T08:42:31Z","title":"Whisper in Medusa's Ear: Multi-head Efficient Decoding for Transformer-based ASR","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15869","snapshot_observed_at":"2026-08-06T14:42:56.099285Z","title":"Whisper in medusa’s ear: Multi-head efficient decoding for transformer- based asr,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.099285Z"},"links":{"cited_paper":"/paper/2409.15869","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:28d4d6ad5a6f28365b9842a721a569139543c88f71b58d4e7ef6f0aa9f1146ed","observation_id":"b228948d-24cb-4c9a-b9f9-dfd6464a26e7","resolution":{"observed_at":"2026-08-06T14:42:56.099285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00430","last_updated":"2023-11-01T10:45:07Z","snapshot_observed_at":"2026-08-08T04:51:03.844048Z","submitted_at":"2023-11-01T10:45:07Z","title":"Distil-Whisper: Robust Knowledge Distillation via Large-Scale Pseudo Labelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00430","snapshot_observed_at":"2026-08-06T14:42:56.105526Z","title":"Distil-whisper: Robust knowledge distillation via large-scale pseudo labelling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.105526Z"},"links":{"cited_paper":"/paper/2311.00430","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:e0e0e47403bdbb773c9c2f349aece20a36af72591bc2eaba48c734b1312989b4","observation_id":"4a12db20-3fba-404d-9755-e144de931249","resolution":{"observed_at":"2026-08-06T14:42:56.105526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-08T15:18:32.322111Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-06T14:42:56.113650Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.113650Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:9e99df0985e20cafba40d0606aafe9a42cc2473402be38b2eb14f922db75ee33","observation_id":"581e39d2-a2e8-4a33-9fa6-4007ec3be640","resolution":{"observed_at":"2026-08-06T14:42:56.113650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.119922Z","title":"Robust speech recognition via large-scale weak supervi- sion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.119922Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:47b2a9058cc198396e72ecf2b19c762ca2ae9a1547762b35616ee6690c0e5da3","observation_id":"a270a48d-e080-4856-923d-6cb749901da6","resolution":{"observed_at":"2026-08-06T14:42:56.119922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T14:42:56.125624Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.125624Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:2067d81865b82f7d9ebe9120927a93658ee773fe53d6d4bc6d9103914aed7408","observation_id":"48df1ca7-cf0c-4c7f-a01b-8286b5a3a499","resolution":{"observed_at":"2026-08-06T14:42:56.125624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T14:42:56.131841Z","title":"Lora: Low-rank adaptation of large language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.131841Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:4ff270079f7b521650e55c4aee12370d6fcd60f38930a4fc3dcd3f160677f0bb","observation_id":"05d14811-e291-4952-8b7b-2341e71d1cb7","resolution":{"observed_at":"2026-08-06T14:42:56.131841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13485","last_updated":"2024-02-21T02:51:07Z","snapshot_observed_at":"2026-07-06T17:33:13.106468Z","submitted_at":"2024-02-21T02:51:07Z","title":"ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding","version":1},"cited_work":{"arxiv_id":"2402.13485","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.13485","snapshot_observed_at":"2026-08-06T14:42:56.429631Z","title":"ProPD: Dynamic Token Tree Pruning and Generation for LLM Parallel Decoding","venue":"cs.LG","work_id":"79221109-7b8d-4654-bd6e-685eefc460ae","year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.137565Z"},"links":{"cited_paper":"/paper/2402.13485","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:8c5ced226d93d2e51434b1794df1aef89f6496a29fddecbb428c6da4a1b1876d","observation_id":"a3fbdefc-9124-4558-89b6-5747d771b5c1","resolution":{"observed_at":"2026-08-06T14:42:56.437339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16858","last_updated":"2024-06-30T15:03:25Z","snapshot_observed_at":"2026-07-06T18:36:12.298104Z","submitted_at":"2024-06-24T17:59:11Z","title":"EAGLE-2: Faster Inference of Language Models with Dynamic Draft Trees","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16858","snapshot_observed_at":"2026-08-06T14:42:56.143024Z","title":"Eagle-2: Faster infer- ence of language models with dynamic draft trees,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.143024Z"},"links":{"cited_paper":"/paper/2406.16858","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:60c286c29fcd6f2e759f3dbdee0fd07056e2000dd350077689b8c21fe1a90f31","observation_id":"f31eb41e-0fe5-4dab-ae74-66c0b9170f8a","resolution":{"observed_at":"2026-08-06T14:42:56.143024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12374","last_updated":"2025-07-05T03:31:01Z","snapshot_observed_at":"2026-08-08T08:32:41.951263Z","submitted_at":"2024-02-19T18:58:32Z","title":"Sequoia: Scalable, Robust, and Hardware-aware Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12374","snapshot_observed_at":"2026-08-06T14:42:56.148559Z","title":"Sequoia: Scalable, robust, and hardware-aware speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.148559Z"},"links":{"cited_paper":"/paper/2402.12374","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:c02d3ee0df4386d94d4dc872dcdef49aa96420b8856f3a4de69fe15d76bd2b7a","observation_id":"2b5560ce-9c21-4436-92ab-f9fec4d89794","resolution":{"observed_at":"2026-08-06T14:42:56.148559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06706","last_updated":"2024-01-12T17:15:23Z","snapshot_observed_at":"2026-08-05T16:37:38.261153Z","submitted_at":"2024-01-12T17:15:23Z","title":"Multi-Candidate Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06706","snapshot_observed_at":"2026-08-06T14:42:56.153661Z","title":"Multi-candidate speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.153661Z"},"links":{"cited_paper":"/paper/2401.06706","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:c8b567480cb786064ac049dedae0a851e0d87fd5025727eb5f8bd1e1eefcafb8","observation_id":"edb5eac1-7dd3-4861-8030-aa164879a2ae","resolution":{"observed_at":"2026-08-06T14:42:56.153661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.158384Z","title":"Librispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.158384Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:3183f64fc81e405063f371eb383cf58324355ea4be3b406c5f4fbf2dfbe1e63e","observation_id":"383dba0e-d0a1-48d7-87a9-4c55d2562b42","resolution":{"observed_at":"2026-08-06T14:42:56.158384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00496","last_updated":"2018-10-28T14:29:46Z","snapshot_observed_at":"2026-07-06T06:58:51.877372Z","submitted_at":"2018-09-03T08:38:34Z","title":"LRS3-TED: a large-scale dataset for visual speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.00496","snapshot_observed_at":"2026-08-06T14:42:56.162477Z","title":"Lrs3-ted: a large-scale dataset for visual speech recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.162477Z"},"links":{"cited_paper":"/paper/1809.00496","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:be3b714388b931e0c65c6b3bea75740046fcb11ac651c8593c9a20d546f2aebb","observation_id":"cd4ce433-0015-48b5-b528-4c77f79762c4","resolution":{"observed_at":"2026-08-06T14:42:56.162477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05589","last_updated":"2024-10-08T01:05:08Z","snapshot_observed_at":"2026-08-06T14:56:30.087964Z","submitted_at":"2024-10-08T01:05:08Z","title":"ParallelSpec: Parallel Drafter for Efficient Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05589","snapshot_observed_at":"2026-08-06T14:42:56.168146Z","title":"Parallel- spec: Parallel drafter for efficient speculative decoding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.168146Z"},"links":{"cited_paper":"/paper/2410.05589","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:2b1fa3ed7f954a402b07a81d6d550772c138acebbfd17e88e191352d5eebbd53","observation_id":"d4c2cbb7-5402-430d-9009-72f954f1f126","resolution":{"observed_at":"2026-08-06T14:42:56.168146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07177","last_updated":"2024-06-10T01:36:31Z","snapshot_observed_at":"2026-07-06T16:30:55.043821Z","submitted_at":"2023-10-11T04:03:42Z","title":"Online Speculative Decoding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07177","snapshot_observed_at":"2026-08-06T14:42:56.172945Z","title":"Online speculative decoding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.172945Z"},"links":{"cited_paper":"/paper/2310.07177","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:3167be8fd1d2e3de72670a816842060b0ba08c2f26aaa87fb90f99322506f597","observation_id":"db89456a-46ca-419a-a6a3-98af10f03b63","resolution":{"observed_at":"2026-08-06T14:42:56.172945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.178146Z","title":"Spectr: Fast speculative decoding via optimal transport,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.178146Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:86e4994cf70794b782b9e1081cee67559ae5bb899fd4595001cd293f2840bafb","observation_id":"f6c432d6-0893-4a3b-98f2-74ff3dd8867c","resolution":{"observed_at":"2026-08-06T14:42:56.178146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14160","last_updated":"2024-03-05T06:55:26Z","snapshot_observed_at":"2026-07-06T17:33:41.634820Z","submitted_at":"2024-02-21T22:57:49Z","title":"Recursive Speculative Decoding: Accelerating LLM Inference via Sampling Without Replacement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14160","snapshot_observed_at":"2026-08-06T14:42:56.183295Z","title":"Recursive speculative decoding: Accelerating llm inference via sampling without replacement,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.183295Z"},"links":{"cited_paper":"/paper/2402.14160","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:36314daf70f6eefcd23fcf2c85548c0f99e14e36f3e4a3b09de3495092e239f5","observation_id":"4a754c70-49bc-4b8d-a26a-8e6d231d0cbf","resolution":{"observed_at":"2026-08-06T14:42:56.183295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09919","last_updated":"2024-12-13T19:50:19Z","snapshot_observed_at":"2026-07-06T17:44:58.325407Z","submitted_at":"2024-03-14T23:40:56Z","title":"Recurrent Drafter for Fast Speculative Decoding in Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09919","snapshot_observed_at":"2026-08-06T14:42:56.188422Z","title":"Recurrent drafter for fast speculative decoding in large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.188422Z"},"links":{"cited_paper":"/paper/2403.09919","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:4810d562e5383d9bb374fa08c3f59286a4c17e3d1ccb06b35a53b13735fe50b3","observation_id":"9faaa76d-0b1c-4be5-b78f-4da91433aea4","resolution":{"observed_at":"2026-08-06T14:42:56.188422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:42:56.796336Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality, march 2023,","venue":null,"work_id":"08b27198-9d17-4a4a-a294-127808daa021","year":2023},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.195443Z"},"links":{"citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:17a1551ae3508088d29e8e1e8e0c5a0e8b217bfa094abff82e06574bffb12472","observation_id":"9cb39e25-dfa2-4929-866e-acc0dc1c65e7","resolution":{"observed_at":"2026-08-06T14:42:56.801696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-06T09:11:01.697195Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-06T14:42:56.200787Z","title":"An embarrassingly simple approach for llm with strong asr capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:42:56.200787Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2507.18181"},"observation_digest":"sha256:51359dbee924a049cde6fff0ad2d6947a6edec7d365a5416bc776d2f536a3ad9","observation_id":"6ac5c690-1150-4e61-b0fd-60d81021b3ca","resolution":{"observed_at":"2026-08-06T14:42:56.200787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18181","last_updated":"2025-07-28T08:55:09Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T03:43:34.568661Z","submitted_at":"2025-07-24T08:27:53Z","title":"SpecASR: Accelerating LLM-based Automatic Speech Recognition via Speculative Decoding"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.18181."}