{"as_of":"2026-08-18T00:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9f24a67357818f7bd72f731edb7f5dde3b9ee832ab2c1a71fdd3c6f3e9cd8cbf","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:06:09.203252Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":18,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:25:35.544478Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-11T03:07:52.420950Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2602.06019","last_updated":"2026-04-23T20:53:41Z","snapshot_observed_at":"2026-08-12T17:09:25.917810Z","submitted_at":"2026-02-05T18:54:48Z","title":"Multi-Token Prediction via Self-Distillation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T06:43:41.128101Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2602.06019"},"observation_digest":"sha256:a6341d446f6618365c09e247e282f2bdebb137b40a0fa4d98316cafecb3500fc","observation_id":"ec7af1b1-1901-4cec-ae7e-30cb6be8303d","resolution":{"observed_at":"2026-05-16T06:47:28.268093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-08-03T04:09:51.950536Z","title":"2, 3, 4, 6 Sandler, J., Christopher, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.06036","last_updated":"2026-05-28T09:13:25Z","snapshot_observed_at":"2026-08-17T00:14:09.618767Z","submitted_at":"2026-02-05T18:59:30Z","title":"DFlash: Block Diffusion for Flash Speculative Decoding","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:51.950536Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2602.06036"},"observation_digest":"sha256:a678cb9a62dbdcec6f1f0967390797bf4f6d3a0cd9e24bf9dc213f18c3e6a792","observation_id":"9677acc8-3ce6-49ce-a503-f5d7a868cdcc","resolution":{"observed_at":"2026-08-03T04:09:51.950536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-08-02T17:49:55.073215Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.22216","last_updated":"2026-07-23T16:32:10Z","snapshot_observed_at":"2026-08-09T02:33:41.982497Z","submitted_at":"2026-03-23T17:13:22Z","title":"Gumbel Distillation for Parallel Text Generation","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-02T17:49:55.073215Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2603.22216"},"observation_digest":"sha256:d7a1b8a845666565e98073137c4150e4a71cde9d853d94921c86060314ac7231","observation_id":"45a00f9f-e97f-4945-be09-b66ca875b0d1","resolution":{"observed_at":"2026-08-02T17:49:55.073215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2604.11912","last_updated":"2026-07-26T04:06:12Z","snapshot_observed_at":"2026-08-15T19:46:06.528118Z","submitted_at":"2026-04-13T18:04:09Z","title":"How Transformers Learn to Plan via Multi-Token Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T15:26:08.402006Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2604.11912"},"observation_digest":"sha256:f453ef383fb7ee7c154c8cc6a831ef82f0b42a48c85c5fad14e96894b954d3d0","observation_id":"0c404396-e1b1-4e78-86ab-383f023aed5d","resolution":{"observed_at":"2026-05-11T10:31:04.888767Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-08-02T16:29:34.232456Z","title":"Mohammad Samragh, Arnav Kundu, David Harrison, Kumari Nishu, Devang Naik, Minsik Cho, and Mehrdad Farajtabar","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2604.11912","last_updated":"2026-07-26T04:06:12Z","snapshot_observed_at":"2026-08-15T19:46:06.528118Z","submitted_at":"2026-04-13T18:04:09Z","title":"How Transformers Learn to Plan via Multi-Token Prediction","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T16:29:34.232456Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2604.11912"},"observation_digest":"sha256:40f87c37fc41957c6a735e07b82a189b1e5a51a1153a5cd44d0e403882b8ca29","observation_id":"7f813327-02f6-4a05-9ea4-0254f0da74fb","resolution":{"observed_at":"2026-08-02T16:29:34.232456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2605.16709","last_updated":"2026-05-15T23:46:22Z","snapshot_observed_at":"2026-08-15T01:54:42.112533Z","submitted_at":"2026-05-15T23:46:22Z","title":"Covert Multi-bit LLM Watermarking: An Information Theory and Coding Approach","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T20:23:10.201061Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2605.16709"},"observation_digest":"sha256:5397bf2892423627021f8da05285f5cbe2381aa568d10ee315e4fe38e2fce564","observation_id":"d46b2bf3-11b5-420b-871b-d94085be0d92","resolution":{"observed_at":"2026-05-19T20:23:12.941216Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2605.20022","last_updated":"2026-05-19T15:48:16Z","snapshot_observed_at":"2026-08-17T15:10:55.121317Z","submitted_at":"2026-05-19T15:48:16Z","title":"FlexDraft: Flexible Speculative Decoding via Attention Tuning and Bonus-Guided Calibration","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T05:57:05.333761Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2605.20022"},"observation_digest":"sha256:c35d5599b581367a592dba17adb19e899f4b79b2e70f0f37603843006c909d8a","observation_id":"fcd04bdc-1784-4fd8-967e-3788d7c1e79d","resolution":{"observed_at":"2026-05-20T05:58:05.173701Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2605.24956","last_updated":"2026-07-12T09:24:31Z","snapshot_observed_at":"2026-08-07T14:43:53.645603Z","submitted_at":"2026-05-24T09:13:12Z","title":"NITP: Next Implicit Token Prediction for LLM Pre-training","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-30T12:23:42.587689Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2605.24956"},"observation_digest":"sha256:3d54ae84b901dfd81e82477b4c2a79bc0f13a436c4900e93ff679c83895bd18e","observation_id":"373fbfef-e4e5-46f0-b003-bfe6d4478a9d","resolution":{"observed_at":"2026-06-30T12:24:39.179776Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2605.24956","last_updated":"2026-07-12T09:24:31Z","snapshot_observed_at":"2026-08-07T14:43:53.645603Z","submitted_at":"2026-05-24T09:13:12Z","title":"NITP: Next Implicit Token Prediction for LLM Pre-training","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-07-04T00:38:33.708836Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2605.24956"},"observation_digest":"sha256:a00a708bf910aa778bdaff8c3199b17edae13ac5ac6090f83a7e0e01a7303444","observation_id":"cd4fa5aa-1bf1-43ac-89bd-3b3cf97fe8cd","resolution":{"observed_at":"2026-07-04T00:39:16.277450Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-14T18:45:28.635910Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential.arXiv preprint arXiv:2507.11851,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.24956","last_updated":"2026-07-12T09:24:31Z","snapshot_observed_at":"2026-08-07T14:43:53.645603Z","submitted_at":"2026-05-24T09:13:12Z","title":"NITP: Next Implicit Token Prediction for LLM Pre-training","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T18:45:28.635910Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2605.24956"},"observation_digest":"sha256:b17363def859f85d845ea4ba054f70a1cf1d591250a894b0ba43c39454414be5","observation_id":"e912ef23-9fff-4880-a03c-c67b89d2f48e","resolution":{"observed_at":"2026-07-14T18:45:28.635910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2605.25745","last_updated":"2026-05-25T11:57:09Z","snapshot_observed_at":"2026-08-06T11:29:59.606951Z","submitted_at":"2026-05-25T11:57:09Z","title":"Selective Latent Thinking: Adaptive Compression of LLM Reasoning Chains","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T21:42:08.610000Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2605.25745"},"observation_digest":"sha256:f329190d46a41c400485096a42b3d66bcdc3248b2c47983cf2b4f672e3125af2","observation_id":"f9af3921-7eb9-47fb-8f7f-c166bdcdaa17","resolution":{"observed_at":"2026-06-29T21:43:59.090000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2605.29727","last_updated":"2026-05-28T10:21:34Z","snapshot_observed_at":"2026-08-14T09:22:35.528617Z","submitted_at":"2026-05-28T10:21:34Z","title":"Bastion: Budget-Aware Speculative Decoding with Tree-structured Block Diffusion Drafting","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-29T08:51:11.662084Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2605.29727"},"observation_digest":"sha256:8b9483f4bf85b0510993bb64935e752d50f30e1592263d2d317c7c10d667b99a","observation_id":"d25fe5d7-0978-4c17-b35a-c3f4941f5763","resolution":{"observed_at":"2026-06-29T08:53:15.768253Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2606.08633","last_updated":"2026-06-07T13:55:11Z","snapshot_observed_at":"2026-08-16T01:56:31.803138Z","submitted_at":"2026-06-07T13:55:11Z","title":"Towards Long-Horizon Vessel Trajectory and Destination Forecasting with Reasoning Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T18:46:28.287989Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2606.08633"},"observation_digest":"sha256:df7fc4c0a307e7344a59196c57bce3c0be8ed0a6911a8b2953e69527c289aeaa","observation_id":"2dbfa245-5f3d-4c8e-873e-72768c2d575a","resolution":{"observed_at":"2026-07-02T22:37:26.047624Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2606.10820","last_updated":"2026-06-10T06:43:22Z","snapshot_observed_at":"2026-07-06T23:49:56.404171Z","submitted_at":"2026-06-09T13:02:00Z","title":"K-Forcing: Joint Next-K-Token Decoding via Push-Forward Language Modeling","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T13:48:35.947498Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2606.10820"},"observation_digest":"sha256:1c9b6c898554bf9bb1606b7e2d87b5d90477f587eb80b9c39afe5c433d5e4233","observation_id":"44728996-e3a8-4e88-9f45-c393ed04d35f","resolution":{"observed_at":"2026-07-03T04:37:36.798979Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2606.31315","last_updated":"2026-06-30T08:24:05Z","snapshot_observed_at":"2026-08-06T20:36:20.361136Z","submitted_at":"2026-06-30T08:24:05Z","title":"BlockPilot: Instance-Adaptive Policy Learning for Diffusion-based Speculative Decoding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-01T05:59:15.199717Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2606.31315"},"observation_digest":"sha256:06a68c602b4ce819dc3c53053cce936452f1c1b0a83a057e2955223ad8e16abd","observation_id":"4282b809-8c0f-4c80-a940-e01e2e2c66e2","resolution":{"observed_at":"2026-07-01T09:55:41.414942Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":"2507.11851","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-07-11T03:07:52.420950Z","title":"Your llm knows the future: Uncovering its multi-token prediction potential","venue":"cs.CL","work_id":"16bb770c-f778-4c03-a015-c2e45263b787","year":2025},"citing_paper":{"arxiv_id":"2607.05722","last_updated":"2026-07-07T01:09:54Z","snapshot_observed_at":"2026-08-06T13:45:31.949136Z","submitted_at":"2026-07-07T01:09:54Z","title":"Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-11T03:04:12.500342Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2607.05722"},"observation_digest":"sha256:30d538f35f25d783893aac1b38a3372581be7589fe386cfc78d589be6f596c70","observation_id":"d4f25567-fa1b-47dd-b588-45e664bba341","resolution":{"observed_at":"2026-07-11T03:07:52.446413Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-08-15T15:25:35.544478Z","title":"arXiv preprint arXiv:2507.11851 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00434","last_updated":"2026-08-01T04:18:49Z","snapshot_observed_at":"2026-08-17T12:05:22.157857Z","submitted_at":"2026-08-01T04:18:49Z","title":"AdaMTP: An Adaptive Training Paradigm for Multi-Token Prediction","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T15:25:35.544478Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2608.00434"},"observation_digest":"sha256:0c9e2de207956b04b5c7dd06205dd0ea922c3f49567c93f0fa462768f2fd6f68","observation_id":"11058976-3e5b-4c53-aeca-19444d6933a2","resolution":{"observed_at":"2026-08-15T15:25:35.544478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.11851","snapshot_observed_at":"2026-08-14T04:36:59.744739Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.08721","last_updated":"2026-08-09T14:15:14Z","snapshot_observed_at":"2026-08-17T17:40:02.327745Z","submitted_at":"2026-08-09T14:15:14Z","title":"LibraSpec: Dynamic Diffusion-Based Speculative Decoding via Marginal-Gain-Driven Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:36:59.744739Z"},"links":{"cited_paper":"/paper/2507.11851","citing_paper":"/paper/2608.08721"},"observation_digest":"sha256:87c30a6fd3ec6a9bf6954192fc089811a546d93ab9e0540d4bd07eddba406ebe","observation_id":"c6793cda-705e-452a-ac94-3fb00b817bd2","resolution":{"observed_at":"2026-08-14T04:36:59.744739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.11851/citation-record","integrity":"/paper/2507.11851/integrity","json":"/paper/2507.11851/citation-record.json","paper":"/paper/2507.11851"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2403.09919","last_updated":"2024-12-13T19:50:19Z","snapshot_observed_at":"2026-08-17T20:55:54.853779Z","submitted_at":"2024-03-14T23:40:56Z","title":"Recurrent Drafter for Fast Speculative Decoding in Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09919","snapshot_observed_at":"2026-08-06T17:06:07.543973Z","title":"Recurrent drafter for fast speculative decoding in large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:07.543973Z"},"links":{"cited_paper":"/paper/2403.09919","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:82d427b931737f6043650c652e473af3add2953b2a97bc2ea0a08ef4e944cc73","observation_id":"fed792ba-de91-4bc2-abbc-1d70904108c2","resolution":{"observed_at":"2026-08-06T17:06:07.543973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-06T17:06:07.660603Z","title":"Large language diffusion models.arXiv preprint arXiv:2502.09992,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:07.660603Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:7d0a7d150d3386985f8658cdf857ee1bb3ac81a558402f54d90ff0cf6eab46cf","observation_id":"179ddcfe-ae73-4577-9805-bfe0c6bbd207","resolution":{"observed_at":"2026-08-06T17:06:07.660603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-16T23:36:44.216328Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-06T17:06:07.820201Z","title":"Better & faster large language models via multi-token prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:07.820201Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:142c488ad896a25476d2ffc01b1ee199bbdc0bd388d1f4e162fb94164d4e84a1","observation_id":"eb912409-3104-47d5-a110-0937887a19c1","resolution":{"observed_at":"2026-08-06T17:06:07.820201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:06:07.954888Z","title":"Hao Chen, Wayne Luk, Ka-Fai Cedric Yiu, Rui Li, Konstantin Mishchenko, Stylianos I","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:07.954888Z"},"links":{"citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:b1177d84dcb1b5ae65728094c8861cd655116b148552833a85fbf26095a960dd","observation_id":"d7655abb-aa9f-4b46-9ca7-d453af31a45c","resolution":{"observed_at":"2026-08-06T17:06:07.954888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18647","last_updated":"2024-04-01T09:48:46Z","snapshot_observed_at":"2026-08-16T14:05:51.353090Z","submitted_at":"2024-03-27T14:54:27Z","title":"SDSAT: Accelerating LLM Inference through Speculative Decoding with Semantic Adaptive Tokens","version":2},"cited_work":{"arxiv_id":"2403.18647","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.18647","snapshot_observed_at":"2026-08-06T17:06:09.605185Z","title":"SDSAT: Accelerating LLM Inference through Speculative Decoding with Semantic Adaptive Tokens","venue":"cs.CL","work_id":"98361fbe-17fd-4f2c-8cd7-b50acd600e8a","year":2024},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.039598Z"},"links":{"cited_paper":"/paper/2403.18647","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:bded9e97c0cec6c631b464f69fc2b7f98ee6b24a38ebe667adb641bd6144eba6","observation_id":"144285d2-0d40-4e1e-b98a-81c04bb835fe","resolution":{"observed_at":"2026-08-06T17:06:09.686027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05589","last_updated":"2024-10-08T01:05:08Z","snapshot_observed_at":"2026-08-16T13:11:42.356677Z","submitted_at":"2024-10-08T01:05:08Z","title":"ParallelSpec: Parallel Drafter for Efficient Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05589","snapshot_observed_at":"2026-08-06T17:06:08.122956Z","title":"org/CorpusID:268723746","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.122956Z"},"links":{"cited_paper":"/paper/2410.05589","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:9ec05124e0699e569be2b1db41c79525651d811f0b7cbef82ee233d2aa697c80","observation_id":"a87f8e9e-bf6d-42db-9450-20fc36edc58b","resolution":{"observed_at":"2026-08-06T17:06:08.122956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-17T14:11:00.232598Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-06T17:06:08.193703Z","title":"Nathan Lambert, Jacob Morrison, Valentina Pyatkin, Shengyi Huang, Hamish Ivison, Faeze Brahman, Lester James V Miranda, Alisa Liu, Nouha Dziri, Shane Lyu, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.193703Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:8b79facb7dcc0fc26d7162a9e85a37277ffe8c12b33125b4345e7eb394f92989","observation_id":"5951cbff-5681-470c-a2e3-973570c325fc","resolution":{"observed_at":"2026-08-06T17:06:08.193703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-06T17:06:08.368714Z","title":"Simian Luo, Yiqin Tan, Longbo Huang, Jian Li, and Hang Zhao","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.368714Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:ad2b1b32c6672a6f9ae661b4c16b2e647e82738fa14e83ae0b0277caa3d6aafc","observation_id":"8e8fe1a6-9f6f-4d04-ac51-1fa02fd9f12c","resolution":{"observed_at":"2026-08-06T17:06:08.368714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:06:08.512707Z","title":"Yuhui Li, Fangyun Wei, Chao Zhang, and Hongyang Zhang","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.512707Z"},"links":{"citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:78c050006fc1a1077fdbb857814d37e7c4953c83efa6839ddbe7854655467011","observation_id":"4ae89b71-4f95-493b-abc5-42fb4efd6825","resolution":{"observed_at":"2026-08-06T17:06:08.512707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T17:06:08.597204Z","title":"Aixin Liu, Bei Feng, Bing Xue, Bingxuan Wang, Bochao Wu, Chengda Lu, Chenggang Zhao, Chengqi Deng, Chenyu Zhang, Chong Ruan, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.597204Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:4d70302896a8f4091c5857dae7165361f115b890c07f4fadcbb3a26bda771406","observation_id":"8661c585-d148-41b0-becb-7b2512e89049","resolution":{"observed_at":"2026-08-06T17:06:08.597204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13581","last_updated":"2023-11-22T18:37:27Z","snapshot_observed_at":"2026-08-16T14:41:04.816246Z","submitted_at":"2023-11-22T18:37:27Z","title":"PaSS: Parallel Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13581","snapshot_observed_at":"2026-08-06T17:06:08.681385Z","title":"Pass: Parallel speculative sampling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.681385Z"},"links":{"cited_paper":"/paper/2311.13581","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:dc23fa6cf65cdeb66e17e36017526d8e80b5ba502808376ac41bbdf3d79a7329","observation_id":"05f19a42-a220-438f-908d-807cda511c44","resolution":{"observed_at":"2026-08-06T17:06:08.681385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05109","last_updated":"2024-10-07T16:21:29Z","snapshot_observed_at":"2026-08-17T14:00:35.798553Z","submitted_at":"2024-02-07T18:58:50Z","title":"Hydra: Sequentially-Dependent Draft Heads for Medusa Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05109","snapshot_observed_at":"2026-08-06T17:06:08.805349Z","title":"semanticscholar.org/CorpusID:270095208","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.805349Z"},"links":{"cited_paper":"/paper/2402.05109","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:d40d8eb1a51b5390fc6dee6c4125a29fbd5dac4ca92bd5173641fe8058c3c12f","observation_id":"953957ee-bfb6-4452-aaca-7c54c0706c1f","resolution":{"observed_at":"2026-08-06T17:06:08.805349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-06T17:06:08.888338Z","title":"Geoffrey E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.888338Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:264438c334e4db354cfcb6bfde442d570bdd975bb29169b715726523ce2ae2ca","observation_id":"d05f2028-9a6d-4196-b4a1-d954c5ca603e","resolution":{"observed_at":"2026-08-06T17:06:08.888338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02281","last_updated":"2018-03-09T03:37:52Z","snapshot_observed_at":"2026-08-14T20:16:17.375580Z","submitted_at":"2017-11-07T04:42:48Z","title":"Non-Autoregressive Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02281","snapshot_observed_at":"2026-08-06T17:06:09.112745Z","title":"semanticscholar.org/CorpusID:263909387","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:09.112745Z"},"links":{"cited_paper":"/paper/1711.02281","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:cb9e6d24b888b72f0379ef5ea1f5e20dd7278d767568256648133e154ece0a67","observation_id":"77c947e7-a230-42c0-b98a-688e1601b8ce","resolution":{"observed_at":"2026-08-06T17:06:09.112745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.07947","last_updated":"2016-09-22T01:17:12Z","snapshot_observed_at":"2026-08-14T21:51:10.458695Z","submitted_at":"2016-06-25T18:16:39Z","title":"Sequence-Level Knowledge Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.07947","snapshot_observed_at":"2026-08-06T17:06:08.965914Z","title":"Yoon Kim and Alexander M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.965914Z"},"links":{"cited_paper":"/paper/1606.07947","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:6de705fe70086bb93f360f641b58f8d0fc11aadd183690df82236d8da2491838","observation_id":"56602a2c-dbe2-43aa-b2f1-ce414a57f331","resolution":{"observed_at":"2026-08-06T17:06:08.965914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08461","last_updated":"2024-03-31T03:06:51Z","snapshot_observed_at":"2026-08-16T14:52:38.095793Z","submitted_at":"2023-10-12T16:21:04Z","title":"DistillSpec: Improving Speculative Decoding via Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08461","snapshot_observed_at":"2026-08-06T17:06:09.036061Z","title":"Yongchao Zhou, Kaifeng Lyu, Ankit Singh Rawat, Aditya Krishna Menon, Afshin Rostamizadeh, Sanjiv Kumar, Jean-François Kagy, and Rishabh Agarwal","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:09.036061Z"},"links":{"cited_paper":"/paper/2310.08461","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:d0e071e03536b68ba5a5c46c2d92374376fc5e40e8475520f3588f2b253e4ffd","observation_id":"8f4ae029-ae34-4189-9f5e-e36b654fd968","resolution":{"observed_at":"2026-08-06T17:06:09.036061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.02727","last_updated":"2021-02-22T20:17:07Z","snapshot_observed_at":"2026-08-17T06:54:42.588927Z","submitted_at":"2019-11-07T02:47:26Z","title":"Understanding Knowledge Distillation in Non-autoregressive Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.02727","snapshot_observed_at":"2026-08-06T17:06:09.203252Z","title":"semanticscholar.org/CorpusID:3480671","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:09.203252Z"},"links":{"cited_paper":"/paper/1911.02727","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:4d3bee19f4c473adced03f98243fa82d1458dd49120aab164dff429e09ffb0dc","observation_id":"6f451723-044a-4d98-a5a8-4cced1afd503","resolution":{"observed_at":"2026-08-06T17:06:09.203252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:06:07.258568Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:07.258568Z"},"links":{"citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:f6f8a87a433035832b86a52c685b6003d7d916eff5bcee5ded5ee1eae4406c2c","observation_id":"37d22381-0cf3-481b-92b5-dead4f02a38b","resolution":{"observed_at":"2026-08-06T17:06:07.258568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-08-17T10:13:54.763177Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-06T17:06:07.323036Z","title":"Medusa: Simple llm inference acceleration framework with multiple decoding heads","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:07.323036Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:db3d2754ba3854c66361faf06f9ceddb2010ebf0e62d4f18b5bb72f6f4345701","observation_id":"82495a85-267a-4614-9c12-dbf976ee69bb","resolution":{"observed_at":"2026-08-06T17:06:07.323036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04623","last_updated":"2023-08-08T23:29:55Z","snapshot_observed_at":"2026-08-16T16:45:25.532419Z","submitted_at":"2023-08-08T23:29:55Z","title":"Accelerating LLM Inference with Staged Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04623","snapshot_observed_at":"2026-08-06T17:06:08.272429Z","title":"Benjamin Spector and Christal Re","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:08.272429Z"},"links":{"cited_paper":"/paper/2308.04623","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:9c8f87ee58cb74460eca13bd23a78c78c8056ad35777e8deb6126be353905d13","observation_id":"24ee1c5b-06d7-49d9-b2a2-488846b39b66","resolution":{"observed_at":"2026-08-06T17:06:08.272429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11131","last_updated":"2024-02-16T23:36:43Z","snapshot_observed_at":"2026-08-16T14:17:49.569062Z","submitted_at":"2024-02-16T23:36:43Z","title":"Speculative Streaming: Fast LLM Inference without Auxiliary Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11131","snapshot_observed_at":"2026-08-06T17:06:07.458918Z","title":"Speculative streaming: Fast llm inference without auxiliary models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:07.458918Z"},"links":{"cited_paper":"/paper/2402.11131","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:0edbc32bc2410ffff6fb45784b2807d5bb795e9d394bd193b7443adcc8b8d661","observation_id":"31054bfa-44b0-4869-8a8e-e466a8545f10","resolution":{"observed_at":"2026-08-06T17:06:07.458918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.20639","last_updated":"2025-06-26T15:46:40Z","snapshot_observed_at":"2026-08-17T13:30:15.045823Z","submitted_at":"2025-06-25T17:35:47Z","title":"DiffuCoder: Understanding and Improving Masked Diffusion Models for Code Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.20639","snapshot_observed_at":"2026-08-06T17:06:07.719627Z","title":"Diffucoder: Understanding and improving masked diffusion models for code generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T17:06:07.719627Z"},"links":{"cited_paper":"/paper/2506.20639","citing_paper":"/paper/2507.11851"},"observation_digest":"sha256:8a27bd13c771a7280e5e658c60beeab2a6a2748ac46e92768e66f042f540783a","observation_id":"3fc2d063-21c9-4eb7-89b0-9d35c9bc826a","resolution":{"observed_at":"2026-08-06T17:06:07.719627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.11851","last_updated":"2025-07-16T02:31:40Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-17T11:16:56.159121Z","submitted_at":"2025-07-16T02:31:40Z","title":"Your LLM Knows the Future: Uncovering Its Multi-Token Prediction Potential"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 18 inbound Pith citation observations for arXiv:2507.11851."}