{"as_of":"2026-08-08T06:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:07e8027cff275094c043510fc44bc497fa6d3abc4efbea57db96769696395a2a","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:32:43.093220Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T17:22:06.965119Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-13T04:07:13.045631Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18629","snapshot_observed_at":"2026-08-03T17:22:06.965119Z","title":"contradiction","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.10054","last_updated":"2026-07-18T20:06:01Z","snapshot_observed_at":"2026-08-05T10:29:34.461734Z","submitted_at":"2025-12-10T20:19:10Z","title":"Parallel Decoder Transformer: Planner-Conditioned Latent Coordination for Model-Intrinsic Parallel Generation","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T17:22:06.965119Z"},"links":{"cited_paper":"/paper/2505.18629","citing_paper":"/paper/2512.10054"},"observation_digest":"sha256:5f003b332234d8b95382d41fa1ebe25892d102158ac0ed3b095f8f6d064e6c6f","observation_id":"0319e73b-0483-4ca8-8267-a1773fa8038c","resolution":{"observed_at":"2026-08-03T17:22:06.965119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"cited_work":{"arxiv_id":"2505.18629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.18629","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Think before you accept: Semantic reflective verification for faster speculative decoding","venue":null,"work_id":"4cab7867-9367-4f28-85f8-33435c190493","year":2025},"citing_paper":{"arxiv_id":"2605.11186","last_updated":"2026-05-11T19:50:08Z","snapshot_observed_at":"2026-07-06T23:23:02.025664Z","submitted_at":"2026-05-11T19:50:08Z","title":"CATS: Cascaded Adaptive Tree Speculation for Memory-Limited LLM Inference Acceleration","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-13T04:06:24.409303Z"},"links":{"cited_paper":"/paper/2505.18629","citing_paper":"/paper/2605.11186"},"observation_digest":"sha256:85b1eee84a3c5ee82ec9fa294698d4957083f8e9b430274baad5171144929b7b","observation_id":"8494809f-5127-4b3c-a4e5-d4f0b40c01c2","resolution":{"observed_at":"2026-05-13T04:07:13.047852Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.18629/citation-record","integrity":"/paper/2505.18629/integrity","json":"/paper/2505.18629/citation-record.json","paper":"/paper/2505.18629"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:32:40.615001Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:40.615001Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:f490fedb29ed1d59f366d81965fb042b57153dc8e041d37667dccfe9a8633d61","observation_id":"ce630a91-039b-4192-b3f3-af796e157ba2","resolution":{"observed_at":"2026-08-07T14:32:40.615001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19309","last_updated":"2025-01-31T17:09:53Z","snapshot_observed_at":"2026-08-08T01:16:56.960700Z","submitted_at":"2025-01-31T17:09:53Z","title":"Judge Decoding: Faster Speculative Sampling Requires Going Beyond Model Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19309","snapshot_observed_at":"2026-08-07T14:32:40.716499Z","title":"Judge decoding: Faster speculative sampling requires going beyond model alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:40.716499Z"},"links":{"cited_paper":"/paper/2501.19309","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:7e9b8bb96dba9154b87719117f7fdaeb869fb887dcd1a6ff4c056ad6d5f10204","observation_id":"ad526306-0027-4d71-8a2f-400985c13325","resolution":{"observed_at":"2026-08-07T14:32:40.716499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:40.845410Z","title":"Fast and robust early-exiting framework for autoregressive language models with synchronized parallel decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:40.845410Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:9c15518f8958b85c4398b599f4ee18bae448e676b24c0605e5f7148f4f94fced","observation_id":"27124c2e-7e86-49f2-afce-31505fa6adb8","resolution":{"observed_at":"2026-08-07T14:32:40.845410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:45.678145Z","title":"Lee, Deming Chen, and Tri Dao","venue":null,"work_id":"5f7634a9-51ef-4042-9c91-c143dbbb8fec","year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:40.918113Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:e95b86999efb72352120794bf18cb1a6f20f64956c118b572c53013b218d2563","observation_id":"8f0c93a9-0840-48e0-b814-976fd4fdb655","resolution":{"observed_at":"2026-08-07T14:32:45.735815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-07T14:32:40.974861Z","title":"Accelerating large language model decoding with speculative sampling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:40.974861Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:09235877839e4ec6931da9112d2762a3a82b75cf59f200b03b18e1eaf1f5dcf4","observation_id":"f7b1bd30-bcaa-4fb8-9ad1-f6ef52553369","resolution":{"observed_at":"2026-08-07T14:32:40.974861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T04:13:14.044604Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-07T14:32:41.066072Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.066072Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:fe2d91097cf7e73a69d5daaef694caf15134e4bb6cd1a92ab805b1635bbf91a3","observation_id":"0429309e-b49a-47e2-9ecb-f6a03113245e","resolution":{"observed_at":"2026-08-07T14:32:41.066072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09567","last_updated":"2025-07-18T15:57:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-12T17:35:03Z","title":"Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09567","snapshot_observed_at":"2026-08-07T14:32:41.149683Z","title":"Towards reasoning era: A survey of long chain-of-thought for reasoning large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.149683Z"},"links":{"cited_paper":"/paper/2503.09567","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:5ddce6240f9a755e3a3d3d1ed8e4350c163e5d9f61f36275be789859412ef7ab","observation_id":"b4e3b7e8-fddc-4c02-934d-0dedaeb7ed33","resolution":{"observed_at":"2026-08-07T14:32:41.149683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T14:32:41.220006Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.220006Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:d646d0d24633dcec1995ee595fe0a29ef5439c322b3c4308c0923d74e3b4957c","observation_id":"2f7a3f45-3c76-44c9-b9ac-347d24cde48d","resolution":{"observed_at":"2026-08-07T14:32:41.220006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:45.468994Z","title":"Break the sequential dependency of LLM inference using lookahead decoding","venue":null,"work_id":"3be11fe7-af1e-4ba8-bcad-cf08f49d0ada","year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.248584Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:db9f1ad9f7963c5a29d0e0fbc648ddf6e1cd231abc576c7ffd27b239b89d19e8","observation_id":"c6a4bc8f-9ae1-4962-9d30-eee3ac6adfcd","resolution":{"observed_at":"2026-08-07T14:32:45.577925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T14:32:41.338601Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.338601Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:db3724415b70cf6ac5a55a5c9d741dcb59f6b7ecb5574f5328a5049cb635edc0","observation_id":"4fdbd671-469b-430d-b2c8-dea4acfb9d39","resolution":{"observed_at":"2026-08-07T14:32:41.338601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:45.266748Z","title":"REST : Retrieval-based speculative decoding","venue":null,"work_id":"a77a9d0f-e04f-489a-9310-7878aab36ca0","year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.444102Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:cfdc20a8d9c77b0b8ba78c7767d3df75fae1f9bb3a0ef6dd0117f999bcfa9ec9","observation_id":"d65dbb13-34a0-444c-8deb-abdca059c4e5","resolution":{"observed_at":"2026-08-07T14:32:45.377668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:44.967886Z","title":"Mahoney, Amir Gholami, and Kurt Keutzer","venue":null,"work_id":"aa8c8d5a-baed-4b7f-9ea2-1c70b4f59bde","year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.517265Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:9c6627ed77de51834153864b7cc38409b3f1a3eed3e2a7071beab8bc5ff1d108","observation_id":"b510cc70-eadf-43c1-b685-8f7f9fcb3a85","resolution":{"observed_at":"2026-08-07T14:32:45.127466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:44.722083Z","title":"Cllms: Consistency large language models","venue":null,"work_id":"f64e78e3-52a8-45e8-ba9a-3384cd8c2f83","year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.555375Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:8965890668e2bc0487a9e3e7545202713982cf788646da362c4291d9f6650493","observation_id":"3803bc4c-e1ed-4851-811c-8da9a3e0ab42","resolution":{"observed_at":"2026-08-07T14:32:44.845926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:44.516855Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"1a438f7a-c8e0-4b9e-a605-a81a116158ff","year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.638614Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:b4fcc52c713a14018686702550b5ddba31f29572b5a6797818dcc44e4d96bb56","observation_id":"5964cfcf-1a34-4ca1-bd4a-35c019ffbc56","resolution":{"observed_at":"2026-08-07T14:32:44.604854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:44.288595Z","title":"EAGLE: speculative sampling requires rethinking feature uncertainty","venue":null,"work_id":"c97c7464-b6eb-4bc3-b7fd-5b2db3802731","year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.775296Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:0db2fdad71e49b39e00e99d8114197b4c123840275d6010e416ae79b7a7f9d0e","observation_id":"964e479a-6aeb-4c27-a514-6dff1cdb0f11","resolution":{"observed_at":"2026-08-07T14:32:44.388475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19324","last_updated":"2025-06-26T03:14:46Z","snapshot_observed_at":"2026-07-06T20:29:07.258163Z","submitted_at":"2025-01-31T17:19:57Z","title":"Reward-Guided Speculative Decoding for Efficient LLM Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19324","snapshot_observed_at":"2026-08-07T14:32:41.836423Z","title":"Reward-guided speculative decoding for efficient llm reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.836423Z"},"links":{"cited_paper":"/paper/2501.19324","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:d6ae08487d4b88254567bf6784b76eddb24b927ac20cf8f3f128a59fd728e3c7","observation_id":"038d5e65-a888-4af9-9498-e1d5a6d4bae4","resolution":{"observed_at":"2026-08-07T14:32:41.836423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T14:32:41.888333Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.888333Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:06ca2a5a013d83353b638571ee40c40f3ab858d7c824b63707a584386d0bb12d","observation_id":"0a8af52e-8067-4a3a-a6bb-72f198f492ee","resolution":{"observed_at":"2026-08-07T14:32:41.888333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:44.086375Z","title":"Online speculative decoding","venue":null,"work_id":"52f6fada-e0f5-4db4-a165-30cc55f0d296","year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:41.979675Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:464e14188e037f40064acab8c1e4a356f11fd950b16ede0026821f8d2a6c1263","observation_id":"02c7f05e-aeb8-4c70-b72e-353f85385a23","resolution":{"observed_at":"2026-08-07T14:32:44.170214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08696","last_updated":"2025-05-25T12:10:14Z","snapshot_observed_at":"2026-08-08T01:17:06.603022Z","submitted_at":"2024-08-16T12:20:56Z","title":"Turning Trash into Treasure: Accelerating Inference of Large Language Models with Token Recycling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08696","snapshot_observed_at":"2026-08-07T14:32:42.069379Z","title":"Turning trash into treasure: Accelerating inference of large language models with token recycling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.069379Z"},"links":{"cited_paper":"/paper/2408.08696","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:a0249cbc4c24db9071181d39ba42aa08f0638dfab0c993955715820e2fc333bc","observation_id":"91872f8d-8c02-43dd-9757-96b0200f32de","resolution":{"observed_at":"2026-08-07T14:32:42.069379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:42.124071Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.124071Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:69cb00e0f6d47aeefaca917185b553fb1e01a7036fd4cbad210f7e36ea7a7611","observation_id":"c626bcc0-b2f1-40e8-ac1f-c1e9a607d7cb","resolution":{"observed_at":"2026-08-07T14:32:42.124071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09781","last_updated":"2024-04-01T02:18:42Z","snapshot_observed_at":"2026-07-06T15:28:24.682211Z","submitted_at":"2023-05-16T20:12:59Z","title":"SpecInfer: Accelerating Generative Large Language Model Serving with Tree-based Speculative Inference and Verification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09781","snapshot_observed_at":"2026-08-07T14:32:42.151725Z","title":"Specinfer: Accelerating generative llm serving with speculative inference and token tree verification","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.151725Z"},"links":{"cited_paper":"/paper/2305.09781","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:e76614f00e7f8607288ae5a4a671361a1ddfbc205cb7b35e611d29d93c85e282","observation_id":"86810514-48c7-49c3-aa91-4611ecd64f7d","resolution":{"observed_at":"2026-08-07T14:32:42.151725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:43.870833Z","title":null,"venue":null,"work_id":"c71cf49d-0b1d-4484-85fc-9c1d0e529c88","year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.196177Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:17278456d5d74b4d9bdc46b19d4b70c1bb266a57312cf9ffac99b4796f114a5d","observation_id":"2bc7c591-b070-42b3-bf47-0805cc71c562","resolution":{"observed_at":"2026-08-07T14:32:43.938971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.09722","last_updated":"2025-04-10T02:35:34Z","snapshot_observed_at":"2026-08-01T12:36:03.890601Z","submitted_at":"2024-07-12T23:29:54Z","title":"Optimized Multi-Token Joint Decoding with Auxiliary Model for LLM Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.09722","snapshot_observed_at":"2026-08-07T14:32:42.269242Z","title":"Optimized multi-token joint decoding with auxiliary model for llm inference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.269242Z"},"links":{"cited_paper":"/paper/2407.09722","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:c33823a321f5d716c16531cc012f963b0b6a420c227edd997111f0456571cf6b","observation_id":"1d8a7156-2701-4718-b3bd-ad8bc95dabaf","resolution":{"observed_at":"2026-08-07T14:32:42.269242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:42.365896Z","title":"Accelerating transformer inference for translation via parallel decoding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.365896Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:ec95c64f32ee40a017bcc3c93f2ffe5151c71c74037373b39201a2c549a1e22a","observation_id":"bc60b96a-f435-428f-a5a2-0015f14e6982","resolution":{"observed_at":"2026-08-07T14:32:42.365896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:43.748847Z","title":"Blockwise parallel decoding for deep autoregressive models","venue":null,"work_id":"ad768180-67e8-44ea-8ce4-e81453e94b02","year":2018},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.436027Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:ff4cb0f1372a8b66e7532fab011ac21ba4e851c5db4a1480b6f055abdc996b27","observation_id":"9279006e-a71f-4d9f-abd0-c2170bff20c8","resolution":{"observed_at":"2026-08-07T14:32:43.796956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17404","last_updated":"2024-10-05T16:20:13Z","snapshot_observed_at":"2026-07-06T18:36:38.636181Z","submitted_at":"2024-06-25T09:25:39Z","title":"Make Some Noise: Unlocking Language Model Parallel Inference Capability through Noisy Training","version":2},"cited_work":{"arxiv_id":"2406.17404","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.17404","snapshot_observed_at":"2026-08-07T14:32:43.245773Z","title":"Make Some Noise: Unlocking Language Model Parallel Inference Capability through Noisy Training","venue":"cs.CL","work_id":"369b1dd1-0956-4505-b3f3-06393259f008","year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.557351Z"},"links":{"cited_paper":"/paper/2406.17404","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:8c5aae074071d04b309463f24f4afaa4a4e235dd480a5b0148164f7ff935d5a2","observation_id":"e6b6df49-cde3-4a09-917a-ad72ed14b9cd","resolution":{"observed_at":"2026-08-07T14:32:43.367300Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:42.653157Z","title":"Speculative decoding: Exploiting speculative execution for accelerating seq2seq generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.653157Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:d69a940711a440fa2c8518a74295293ad110a68a8367789034bea963ec70d06e","observation_id":"9348587d-f7b3-4433-b6f9-b950c8389372","resolution":{"observed_at":"2026-08-07T14:32:42.653157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07851","last_updated":"2024-06-04T17:08:37Z","snapshot_observed_at":"2026-07-06T17:15:46.395218Z","submitted_at":"2024-01-15T17:26:50Z","title":"Unlocking Efficiency in Large Language Model Inference: A Comprehensive Survey of Speculative Decoding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.07851","snapshot_observed_at":"2026-08-07T14:32:42.749845Z","title":"Unlocking efficiency in large language model inference: A comprehensive survey of speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.749845Z"},"links":{"cited_paper":"/paper/2401.07851","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:89007eda71c1cfab94f8ca79e40d21dc8a420e3b7de781a66d68cc25532fca54","observation_id":"3aea8502-c3da-49e5-bd95-5429f5c2cbae","resolution":{"observed_at":"2026-08-07T14:32:42.749845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04315","last_updated":"2024-12-06T11:39:27Z","snapshot_observed_at":"2026-08-04T05:54:36.205023Z","submitted_at":"2024-12-05T16:31:13Z","title":"Densing Law of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04315","snapshot_observed_at":"2026-08-07T14:32:42.812379Z","title":"Densing law of llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.812379Z"},"links":{"cited_paper":"/paper/2412.04315","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:267d7479b560a954b9061d2bcd3e8794c9970306fc04c087225971dc96ccca16","observation_id":"9902f502-2188-40e4-ad7d-855b05649d8e","resolution":{"observed_at":"2026-08-07T14:32:42.812379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04487","last_updated":"2023-04-10T09:55:14Z","snapshot_observed_at":"2026-07-06T15:13:55.345422Z","submitted_at":"2023-04-10T09:55:14Z","title":"Inference with Reference: Lossless Acceleration of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.04487","snapshot_observed_at":"2026-08-07T14:32:42.841436Z","title":"Inference with reference: Lossless acceleration of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.841436Z"},"links":{"cited_paper":"/paper/2304.04487","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:be1e0c51fd1ac3187ba7d36389f79c9c2755be2489c7346dbf3d01cb44bb4dea","observation_id":"c436f607-dba2-4d78-bc90-cc096442bc52","resolution":{"observed_at":"2026-08-07T14:32:42.841436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06706","last_updated":"2024-01-12T17:15:23Z","snapshot_observed_at":"2026-08-05T16:37:38.261153Z","submitted_at":"2024-01-12T17:15:23Z","title":"Multi-Candidate Speculative Decoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06706","snapshot_observed_at":"2026-08-07T14:32:42.878263Z","title":"Multi-candidate speculative decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.878263Z"},"links":{"cited_paper":"/paper/2401.06706","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:afe74b77929d8de124466f51f77b3d8393d11ca3a81f701844c697af7fe38ff0","observation_id":"40fd7d9d-b6aa-4643-85bd-8910c46ec041","resolution":{"observed_at":"2026-08-07T14:32:42.878263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16293","last_updated":"2024-08-29T06:49:20Z","snapshot_observed_at":"2026-08-04T04:22:16.650100Z","submitted_at":"2024-08-29T06:49:20Z","title":"Physics of Language Models: Part 2.2, How to Learn From Mistakes on Grade-School Math Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16293","snapshot_observed_at":"2026-08-07T14:32:42.925594Z","title":"Physics of language models: Part 2.2, how to learn from mistakes on grade-school math problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.925594Z"},"links":{"cited_paper":"/paper/2408.16293","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:9e66bf34254b373b28c6b7cbb664c9d1cce7efcc580f40e9443e73a76d9f22ee","observation_id":"b59d3046-559f-4cf2-951f-1b2b0749e4a1","resolution":{"observed_at":"2026-08-07T14:32:42.925594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:42.991535Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:42.991535Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:1f9a5c5564d7c426bf9778d3e8e67c4acf150e4afbb2bbeab4c81c5af4eb1974","observation_id":"1877e3ca-a752-450a-97c6-460feb67cab9","resolution":{"observed_at":"2026-08-07T14:32:42.991535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:32:43.587342Z","title":"Distillspec: Improving speculative decoding via knowledge distillation","venue":null,"work_id":"dedab67f-e6c1-40a6-8748-aec6035584c0","year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:43.063373Z"},"links":{"citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:f37b4167e4147d6280dee4d9cd6889ebea3253421fa0b02f817cdec3c7f3ef22","observation_id":"bac95506-4240-4cb2-adcc-2fcaed54342a","resolution":{"observed_at":"2026-08-07T14:32:43.666336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-07T14:32:43.093220Z","title":"A survey on efficient inference for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:43.093220Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2505.18629"},"observation_digest":"sha256:149849deb935b3abbdd938072cd4782fbbd1db454874b1250f453fd70e08fd13","observation_id":"d357a65e-6426-42b7-b63c-fe9ce9c5c04e","resolution":{"observed_at":"2026-08-07T14:32:43.093220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.18629","last_updated":"2025-05-24T10:26:27Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T01:06:18.417714Z","submitted_at":"2025-05-24T10:26:27Z","title":"Think Before You Accept: Semantic Reflective Verification for Faster Speculative Decoding"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 2 inbound Pith citation observations for arXiv:2505.18629."}