{"as_of":"2026-08-08T05:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc69e0fd27669548d83d6ca5865006559b0b8b5ff3df8a1d2e5629b8cb2b88fb","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:30:34.483002Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:02:10.742834Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T22:07:26.497548Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"cited_work":{"arxiv_id":"2506.05333","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.05333","snapshot_observed_at":"2026-07-02T22:07:26.497548Z","title":"Kinetics: Rethinking test-time scaling laws, 2025.https://arxiv.org/abs/2506.05333","venue":null,"work_id":"22e35b46-e0cf-445c-9b08-42c8d8ef149b","year":2025},"citing_paper":{"arxiv_id":"2606.08446","last_updated":"2026-06-07T04:24:45Z","snapshot_observed_at":"2026-08-05T08:26:57.919131Z","submitted_at":"2026-06-07T04:24:45Z","title":"Sparrow: Sparse Rollout for Stable and Efficient Long-context RL of Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T19:10:53.882876Z"},"links":{"cited_paper":"/paper/2506.05333","citing_paper":"/paper/2606.08446"},"observation_digest":"sha256:f531e11ff041caf8520bcc1646487f0242037ef75cda05a251ce15de3a7989c2","observation_id":"a9623f3c-31bf-46fb-83f7-9e303317fef2","resolution":{"observed_at":"2026-07-02T22:07:26.499198Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05333","snapshot_observed_at":"2026-08-05T05:02:10.742834Z","title":"Kinetics: Rethinking test-time scaling laws","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03961","last_updated":"2026-08-04T17:27:21Z","snapshot_observed_at":"2026-08-07T23:12:44.813578Z","submitted_at":"2026-08-04T17:27:21Z","title":"Interpretable Adaptive Sampling for LLM Test-Time Scaling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T05:02:10.742834Z"},"links":{"cited_paper":"/paper/2506.05333","citing_paper":"/paper/2608.03961"},"observation_digest":"sha256:48d0a3b57d4ec967df7ef2b870d065d963e84186c799e412867bc3ef3d43f854","observation_id":"729314ea-acfa-49bb-bb0f-bc4e55f461f7","resolution":{"observed_at":"2026-08-05T05:02:10.742834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.05333/citation-record","integrity":"/paper/2506.05333/integrity","json":"/paper/2506.05333/citation-record.json","paper":"/paper/2506.05333"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-06T08:05:35.311510Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-07T10:30:34.136063Z","title":"Generating long sequences with sparse transformers.arXiv preprint arXiv:1904.10509,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.136063Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:6986cfa177d4b901ecbb02c831e04acbe53367a901c0248b3696ec99c0549e4f","observation_id":"c3e1c9aa-981e-44c0-8247-7aadfae2d0be","resolution":{"observed_at":"2026-08-07T10:30:34.136063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06066","last_updated":"2024-01-11T17:31:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-11T17:31:42Z","title":"DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06066","snapshot_observed_at":"2026-08-07T10:30:34.146751Z","title":"Deepseekmoe: Towards ultimate expert specialization in mixture-of-experts language models.arXiv preprint arXiv:2401.06066,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.146751Z"},"links":{"cited_paper":"/paper/2401.06066","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:138f69444fb063baaf3ed0a83d930ff72bfa5a39baca19651f1e93ca011cacbd","observation_id":"7aa74093-ead3-4172-96c2-0b2c6f2007ea","resolution":{"observed_at":"2026-08-07T10:30:34.146751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-07T10:30:34.153354Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning.CoRR, abs/2307.08691,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.153354Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:90e810e80ac23e347c31e1f83bfcb94841dc19f0267c9e5feb51646b109f452d","observation_id":"fc427bd5-eeff-4989-8953-b7c0243effef","resolution":{"observed_at":"2026-08-07T10:30:34.153354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-07T10:30:34.160223Z","title":"Tri Dao, Beidi Chen, Kaizhao Liang, Jiaming Yang, Zhao Song, Atri Rudra, and Christopher R´ e","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.160223Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:86af1beb28e6b638fe95c538725c6d86bb6a529d0c0a97e3ad56e93ccdd20815","observation_id":"cf4f7989-60bf-438d-b22d-0a3edc53b3a2","resolution":{"observed_at":"2026-08-07T10:30:34.160223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-07T10:30:34.170568Z","title":"Palm-e: An embodied multimodal language model.arXiv preprint arXiv:2303.03378,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.170568Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:090b2efb12e2441199c87bf1629abff966b41ef9896b909edb34540d0149d4a6","observation_id":"f07d6d81-b35a-4556-88e7-8332586eead3","resolution":{"observed_at":"2026-08-07T10:30:34.170568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.06905","last_updated":"2022-08-01T21:07:58Z","snapshot_observed_at":"2026-07-06T12:18:14.988251Z","submitted_at":"2021-12-13T18:58:19Z","title":"GLaM: Efficient Scaling of Language Models with Mixture-of-Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.06905","snapshot_observed_at":"2026-08-07T10:30:34.175386Z","title":"Dai, Simon Tong, Dmitry Lepikhin, Yuanzhong Xu, Dehao Chen, Yonghui Wu, and Jeff Dean","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.175386Z"},"links":{"cited_paper":"/paper/2112.06905","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:e25af8b44e4de4d488abc88b21ae8e84c3e88cde5e4e265fa6c84c541a3f77d7","observation_id":"d1bb6067-0114-418b-88a9-1221a291043c","resolution":{"observed_at":"2026-08-07T10:30:34.175386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17179","last_updated":"2024-02-09T00:13:46Z","snapshot_observed_at":"2026-07-06T16:25:25.534843Z","submitted_at":"2023-09-29T12:20:19Z","title":"Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17179","snapshot_observed_at":"2026-08-07T10:30:34.180416Z","title":"Alphazero-like tree-search can guide large language model decoding and training.arXiv preprint arXiv:2309.17179,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.180416Z"},"links":{"cited_paper":"/paper/2309.17179","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:4af3a44ad62d99b640cd27dbb202c164a8a50cef1cade54ee94e5d51422a07f5","observation_id":"650cc220-635d-40a7-87eb-790fc13501dd","resolution":{"observed_at":"2026-08-07T10:30:34.180416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.17323","last_updated":"2023-03-22T13:10:47Z","snapshot_observed_at":"2026-08-07T08:38:54.025062Z","submitted_at":"2022-10-31T13:42:40Z","title":"GPTQ: Accurate Post-Training Quantization for Generative Pre-trained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.17323","snapshot_observed_at":"2026-08-07T10:30:34.185621Z","title":"Gptq: Accurate post-training quantization for generative pre-trained transformers.arXiv preprint arXiv:2210.17323,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.185621Z"},"links":{"cited_paper":"/paper/2210.17323","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:a633de94cb6290b27ded12e8628d5fc9355d66d12f9bec45331a247f76f77494","observation_id":"e8808f87-8187-46b3-9431-efdea686e8d3","resolution":{"observed_at":"2026-08-07T10:30:34.185621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20993","last_updated":"2025-05-27T16:41:53Z","snapshot_observed_at":"2026-07-06T20:14:40.579474Z","submitted_at":"2024-12-30T14:57:53Z","title":"Efficiently Scaling LLM Reasoning with Certaindex","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20993","snapshot_observed_at":"2026-08-07T10:30:34.191878Z","title":"Efficiently serving llm reasoning programs with certaindex.arXiv preprint arXiv:2412.20993,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.191878Z"},"links":{"cited_paper":"/paper/2412.20993","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:497f10a707d3e2fd7d4cc4feaf8b7a9e7fb39c1157ab8710e5dcd56e3c359f0e","observation_id":"cd607189-bf74-479a-b376-433772d9fc8f","resolution":{"observed_at":"2026-08-07T10:30:34.191878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T10:30:34.197508Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.197508Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:fa0175551b32a1410bb1854f052b9618b7d11f8859dbab83584aa2163470190d","observation_id":"4d7580f4-6f6a-4601-8cf5-dec88e8761c1","resolution":{"observed_at":"2026-08-07T10:30:34.197508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T10:30:34.202494Z","title":"Mamba: Linear-time sequence modeling with selective state spaces.CoRR, abs/2312.00752,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.202494Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:a60a15e120653577dd5c31b962fdf15256bdd96a74d9a07b0903c0d9aa1584e3","observation_id":"2de62fc4-092b-4c85-b8e4-cf4f2fee8dcb","resolution":{"observed_at":"2026-08-07T10:30:34.202494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T10:30:34.208033Z","title":"Albert Gu, Karan Goel, and Christopher R´ e","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.208033Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:088e9b8fc6b82364a30b0c75b7fcee0e56619304b1ea13d87958f4551d4075bc","observation_id":"319cf6c5-7717-482b-82be-f44cf6209a58","resolution":{"observed_at":"2026-08-07T10:30:34.208033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T10:30:34.212638Z","title":"Daya Guo, Dejian Yang, Haowei Zhang, Junxiao Song, Ruoyu Zhang, Runxin Xu, Qihao Zhu, Shirong Ma, Peiyi Wang, Xiao Bi, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.212638Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:5f89166638187fc8a70f874050c638abf80b4bf24b15aaeddf44c445db14a0ef","observation_id":"3213fc27-0748-4506-95da-a7dcec5555fc","resolution":{"observed_at":"2026-08-07T10:30:34.212638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-07T06:05:27.895209Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-07T10:30:34.218780Z","title":"Training large language models to reason in a continuous latent space.arXiv preprint arXiv:2412.06769,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.218780Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:054219e46daa6f6d8036b28e7d349d254f54411c43046dfd1a13983a6f0a4974","observation_id":"4e81297c-22a1-4a77-a4fa-b7a48f9c5cc0","resolution":{"observed_at":"2026-08-07T10:30:34.218780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11421","last_updated":"2024-03-18T02:30:23Z","snapshot_observed_at":"2026-08-06T20:15:05.193939Z","submitted_at":"2024-03-18T02:30:23Z","title":"FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11421","snapshot_observed_at":"2026-08-07T10:30:34.224262Z","title":"Fastdecode: High-throughput gpu-efficient llm serving using heterogeneous pipelines.arXiv preprint arXiv:2403.11421,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.224262Z"},"links":{"cited_paper":"/paper/2403.11421","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:966973dce92a2695c3bcd11d178dfc1128b7e24524926f93f7a85dd23403cbc5","observation_id":"25305e44-e40b-428b-8584-0e4fcba07bfe","resolution":{"observed_at":"2026-08-07T10:30:34.224262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T10:30:34.229702Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.229702Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:40f11d87055b7bd7d98e56403c0f1c37c1f6de4d45058932409b5c897bb7596b","observation_id":"aebe028f-b09b-4c04-a860-f3b569b824fc","resolution":{"observed_at":"2026-08-07T10:30:34.229702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11147","last_updated":"2025-05-30T11:43:48Z","snapshot_observed_at":"2026-08-07T18:14:42.386201Z","submitted_at":"2025-02-16T14:28:52Z","title":"RaaS: Reasoning-Aware Attention Sparsity for Efficient LLM Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11147","snapshot_observed_at":"2026-08-07T10:30:34.235097Z","title":"Junhao Hu, Wenrui Huang, Weidong Wang, Zhenwen Li, Tiancheng Hu, Zhixia Liu, Xusheng Chen, Tao Xie, and Yizhou Shan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.235097Z"},"links":{"cited_paper":"/paper/2502.11147","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:9dce4264f6a52bfd33f1a5d4418279b77b3ac15dc51faf7238a79acc9f5eaf2f","observation_id":"3ff9ac0f-3a18-4191-aadb-294c016b1eaa","resolution":{"observed_at":"2026-08-07T10:30:34.235097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.07207","last_updated":"2022-03-08T06:47:17Z","snapshot_observed_at":"2026-08-06T08:07:23.771593Z","submitted_at":"2022-01-18T18:59:45Z","title":"Language Models as Zero-Shot Planners: Extracting Actionable Knowledge for Embodied Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.07207","snapshot_observed_at":"2026-08-07T10:30:34.240829Z","title":"Language models as zero-shot planners: Extracting actionable knowledge for embodied agents.arXiv preprint arXiv:2201.07207,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.240829Z"},"links":{"cited_paper":"/paper/2201.07207","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:356abaf4f9252217bc75eef50e9ae84b7fb1cb0095e4c445e9bc68007db82ca6","observation_id":"e4684d1b-ae3d-4eea-adfa-6af9104d73fb","resolution":{"observed_at":"2026-08-07T10:30:34.240829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T10:30:34.245848Z","title":"Openai o1 system card.arXiv preprint arXiv:2412.16720,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.245848Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:ed0fe254a64c4870de7af8b6738dedd5ab5daab3434e0cecd9cb04effb46157d","observation_id":"9de9fd75-cbd9-49e7-a418-2b2aa24193d3","resolution":{"observed_at":"2026-08-07T10:30:34.245848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-07T10:30:34.250861Z","title":"Livecodebench: Holistic and contamination free evaluation of large language models for code.arXiv preprint arXiv:2403.07974,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.250861Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:78d25729dada38d5fef33a8ce0bae95293c0d4b53fa356104159f309db56a4a3","observation_id":"84c4ef5b-3e5d-487b-9efe-7f809c9c3acc","resolution":{"observed_at":"2026-08-07T10:30:34.250861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-07T13:04:50.040909Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T10:30:34.256194Z","title":"Mixtral of experts.arXiv preprint arXiv:2401.04088,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.256194Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:695048c5385fbddb121c6857687757867cd26ebe6b1510ed9dda248a96b5d0b7","observation_id":"d77db131-9fdd-4270-b3d4-b60bceb9474a","resolution":{"observed_at":"2026-08-07T10:30:34.256194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05099","last_updated":"2024-05-13T08:49:44Z","snapshot_observed_at":"2026-08-04T23:21:31.317269Z","submitted_at":"2024-02-07T18:53:01Z","title":"Hydragen: High-Throughput LLM Inference with Shared Prefixes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05099","snapshot_observed_at":"2026-08-07T10:30:34.260984Z","title":"Hydragen: High-throughput llm inference with shared prefixes.arXiv preprint arXiv:2402.05099,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.260984Z"},"links":{"cited_paper":"/paper/2402.05099","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:9e3e88dbb6689e3a5f32255228262bca62e501c1eed7a6426dc09de4d2ba9e20","observation_id":"4b210226-1ba2-46f0-94b8-7912b1eae50a","resolution":{"observed_at":"2026-08-07T10:30:34.260984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T10:30:34.265868Z","title":"Scaling laws for neural language models.arXiv preprint arXiv:2001.08361,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.265868Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:20ae7d870b51eaec98458c68cb1c85c39a6b547a1c9fa53533764fc6cd4f8e21","observation_id":"5bc68a94-3af1-46cf-a565-c8e3bcc9ba3e","resolution":{"observed_at":"2026-08-07T10:30:34.265868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.791219Z","title":"Transformers are rnns: Fast autoregressive transformers with linear attention","venue":null,"work_id":"b23b5011-04cf-4872-9793-439fa9c4f92b","year":2020},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.271141Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:a9d164dc21ee2e2fd84256d97dd7682553c3cf4b5c4fb010bb1993dbb8cb1d17","observation_id":"76025da5-ef94-4ebe-8eeb-f32aeb2484fd","resolution":{"observed_at":"2026-08-07T10:30:35.796708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04330","last_updated":"2024-11-30T02:42:31Z","snapshot_observed_at":"2026-08-04T07:47:22.112536Z","submitted_at":"2024-11-07T00:10:10Z","title":"Scaling Laws for Precision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04330","snapshot_observed_at":"2026-08-07T10:30:34.276380Z","title":"Scaling laws for precision.arXiv preprint arXiv:2411.04330,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.276380Z"},"links":{"cited_paper":"/paper/2411.04330","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:d0e3d7a33d90f8bfd61bfe364081b9cc7fa61c594e33350494008e3f3ebeaf31","observation_id":"1d234a47-80c2-4656-af6e-d0da2da7c236","resolution":{"observed_at":"2026-08-07T10:30:34.276380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06180","last_updated":"2023-09-12T12:50:04Z","snapshot_observed_at":"2026-08-02T09:51:08.145755Z","submitted_at":"2023-09-12T12:50:04Z","title":"Efficient Memory Management for Large Language Model Serving with PagedAttention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.06180","snapshot_observed_at":"2026-08-07T10:30:34.281722Z","title":"Yaniv Leviathan, Matan Kalman, and Yossi Matias","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.281722Z"},"links":{"cited_paper":"/paper/2309.06180","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:f81b420e5e75af9efe39d07293a51d0096474a4eb0a8a2e2e0f574ff1d026003","observation_id":"dd93f266-aebd-4860-898d-fa8039fe0722","resolution":{"observed_at":"2026-08-07T10:30:34.281722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14469","last_updated":"2024-06-17T03:01:58Z","snapshot_observed_at":"2026-08-07T22:57:56.263839Z","submitted_at":"2024-04-22T17:42:58Z","title":"SnapKV: LLM Knows What You are Looking for Before Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14469","snapshot_observed_at":"2026-08-07T10:30:34.286618Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.286618Z"},"links":{"cited_paper":"/paper/2404.14469","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:6e73e890eebd546829fe6dd4fcc807ab2ebd77486641d65b29476da5f09f5740","observation_id":"b2454521-1f96-4c0d-9db6-19094b230dda","resolution":{"observed_at":"2026-08-07T10:30:34.286618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.04532","last_updated":"2025-05-01T02:14:05Z","snapshot_observed_at":"2026-08-08T04:42:16.973896Z","submitted_at":"2024-05-07T17:59:30Z","title":"QServe: W4A8KV4 Quantization and System Co-design for Efficient LLM Serving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.04532","snapshot_observed_at":"2026-08-07T10:30:34.291765Z","title":"Awq: Activation-aware weight quantization for on-device llm compression and acceleration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.291765Z"},"links":{"cited_paper":"/paper/2405.04532","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:c9533377b521e8d5211d44c20fb917c0ea87bec5861952ef420391048e345d61","observation_id":"3f9b9dfd-afad-454e-860b-10b93b92b3a4","resolution":{"observed_at":"2026-08-07T10:30:34.291765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02750","last_updated":"2024-07-25T09:16:05Z","snapshot_observed_at":"2026-07-06T17:25:18.238343Z","submitted_at":"2024-02-05T06:06:47Z","title":"KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02750","snapshot_observed_at":"2026-08-07T10:30:34.297272Z","title":"Kivi: A tuning-free asymmetric 2bit quantization for kv cache.arXiv preprint arXiv:2402.02750, 2024c","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.297272Z"},"links":{"cited_paper":"/paper/2402.02750","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:df633af190311ee83928c0b7fb877e8831c4d8eae078ca09416af723ffaa1e81","observation_id":"ae6aa1cd-1746-42ff-8082-e452897bb7ce","resolution":{"observed_at":"2026-08-07T10:30:34.297272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.773191Z","title":null,"venue":null,"work_id":"e4fb5c58-d5da-4bce-9aa7-31bb4cdfeac0","year":2025},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.302439Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:80ee736e364c8bcde32fd6294617f1ce885880075531e9cb97278d035676df6f","observation_id":"2d9c9fdf-5334-4227-925f-8f8302f45092","resolution":{"observed_at":"2026-08-07T10:30:35.778962Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08246","last_updated":"2025-06-03T10:07:35Z","snapshot_observed_at":"2026-08-08T05:49:05.821041Z","submitted_at":"2025-02-12T09:39:54Z","title":"Inference-time sparse attention with asymmetric indexing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08246","snapshot_observed_at":"2026-08-07T10:30:34.307068Z","title":"Pierre-Emmanuel Mazar´ e, Gergely Szilvasy, Maria Lomeli, Francisco Massa, Naila Murray, Herv´ e J´ egou, and Matthijs Douze","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.307068Z"},"links":{"cited_paper":"/paper/2502.08246","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:55d9aeccfc4db333a31384d47e5be6380b3f328bc24bc415229a7bc343c9611b","observation_id":"327fddec-e36e-4899-b590-8eb377646723","resolution":{"observed_at":"2026-08-07T10:30:34.307068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09781","last_updated":"2024-04-01T02:18:42Z","snapshot_observed_at":"2026-07-06T15:28:24.682211Z","submitted_at":"2023-05-16T20:12:59Z","title":"SpecInfer: Accelerating Generative Large Language Model Serving with Tree-based Speculative Inference and Verification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09781","snapshot_observed_at":"2026-08-07T10:30:34.312390Z","title":"Specinfer: Accelerating generative large language model serving with tree-based speculative inference and verification.arXiv preprint arXiv:2305.09781,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.312390Z"},"links":{"cited_paper":"/paper/2305.09781","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:4b50c3e6f23dbfe6be6732265a3f536754755333b440a2d22f6664e256572bae","observation_id":"6d6b4959-a0ee-4c86-bf6a-b733d232845e","resolution":{"observed_at":"2026-08-07T10:30:34.312390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08378","last_updated":"2021-04-16T21:27:32Z","snapshot_observed_at":"2026-08-04T11:24:11.301809Z","submitted_at":"2021-04-16T21:27:32Z","title":"Accelerating Sparse Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08378","snapshot_observed_at":"2026-08-07T10:30:34.317338Z","title":"Accelerating sparse deep neural networks.arXiv preprint arXiv:2104.08378,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.317338Z"},"links":{"cited_paper":"/paper/2104.08378","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:1ab621276a922bd03f0ac106a0902ab27074ae162468a93c9de6fe4dc46c7ded","observation_id":"a848a160-e230-4f4b-b078-7d83ce424bda","resolution":{"observed_at":"2026-08-07T10:30:34.317338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10845","last_updated":"2024-08-14T20:41:56Z","snapshot_observed_at":"2026-07-06T16:34:11.453458Z","submitted_at":"2023-10-16T21:37:34Z","title":"CoTFormer: A Chain-of-Thought Driven Architecture with Budget-Adaptive Computation Cost at Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10845","snapshot_observed_at":"2026-08-07T10:30:34.322488Z","title":"Cotformer: A chain-of-thought driven architecture with budget-adaptive computation cost at inference.arXiv preprint arXiv:2310.10845,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.322488Z"},"links":{"cited_paper":"/paper/2310.10845","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:fa4f61a60ae6693027f53554c2b32394f711be452c9af24ac8486bcc588752f3","observation_id":"743c9c38-d04b-4836-b21a-06d09e09ade4","resolution":{"observed_at":"2026-08-07T10:30:34.322488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-07T17:14:39.278754Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-07T10:30:34.332718Z","title":"Webgpt: Browser-assisted question-answering with human feedback","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.332718Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:0d308b22219a71aa2beab66791113aadb88805c618b293cb9861b90f822da123","observation_id":"a713a549-6d60-4aff-ba70-eaf95ecab93c","resolution":{"observed_at":"2026-08-07T10:30:34.332718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17768","last_updated":"2026-06-22T18:38:34Z","snapshot_observed_at":"2026-08-07T15:59:25.196048Z","submitted_at":"2025-04-24T17:39:25Z","title":"The Sparse Frontier: Sparse Attention Trade-offs in Transformer LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17768","snapshot_observed_at":"2026-08-07T10:30:34.338653Z","title":"The sparse frontier: Sparse attention trade-offs in transformer llms.arXiv preprint arXiv:2504.17768,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.338653Z"},"links":{"cited_paper":"/paper/2504.17768","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:2b750ce8bb4aa0a05744c4d88138225fcf1009057e15c92a9cd9c8a393c41230","observation_id":"c18310f8-bbd4-46bd-84b3-15266c4354f5","resolution":{"observed_at":"2026-08-07T10:30:34.338653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15337","last_updated":"2024-03-02T02:45:33Z","snapshot_observed_at":"2026-07-06T15:59:34.968253Z","submitted_at":"2023-07-28T06:31:34Z","title":"Skeleton-of-Thought: Prompting LLMs for Efficient Parallel Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15337","snapshot_observed_at":"2026-08-07T10:30:34.344195Z","title":"Skeleton-of-thought: Prompting llms for efficient parallel generation.arXiv preprint arXiv:2307.15337,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.344195Z"},"links":{"cited_paper":"/paper/2307.15337","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:eb0a14a87846fab9c57d3f15fa1d3f6b3028b920505bcd1f1e0256ca93a5fe4a","observation_id":"f6c34e59-d711-4541-a1ac-66f583637435","resolution":{"observed_at":"2026-08-07T10:30:34.344195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.755570Z","title":"Daniele Paliotta, Junxiong Wang, Matteo Pagliardini, Kevin Y","venue":null,"work_id":"2fd96820-0720-472b-a711-0823b70257f4","year":2025},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.350075Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:6e8e71ba260f7242ad8fc52372b83b6416fb51ccec2a5a0a8e3190bd521d1aa1","observation_id":"9e2c1442-353e-4789-9106-62e5ca832e3e","resolution":{"observed_at":"2026-08-07T10:30:35.761542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20339","last_updated":"2025-02-27T18:08:16Z","snapshot_observed_at":"2026-08-07T17:42:05.982836Z","submitted_at":"2025-02-27T18:08:16Z","title":"Thinking Slow, Fast: Scaling Inference Compute with Distilled Reasoners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20339","snapshot_observed_at":"2026-08-07T10:30:34.355793Z","title":"org/abs/2502.20339","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.355793Z"},"links":{"cited_paper":"/paper/2502.20339","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:df39bff9d1722d7733d15224e080cb125cd887e0e1f9bd89331265e38097bca7","observation_id":"5a899b0a-ddf2-4b4d-925a-6af2c1f3fde8","resolution":{"observed_at":"2026-08-07T10:30:34.355793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11049","last_updated":"2025-04-02T01:58:38Z","snapshot_observed_at":"2026-08-08T01:17:07.764692Z","submitted_at":"2024-08-20T17:57:31Z","title":"MagicDec: Breaking the Latency-Throughput Tradeoff for Long Context Generation with Speculative Decoding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11049","snapshot_observed_at":"2026-08-07T10:30:34.361014Z","title":"Ranajoy Sadhukhan, Jian Chen, Zhuoming Chen, Vashisth Tiwari, Ruihang Lai, Jinyuan Shi, Ian En-Hsu Yen, Avner May, Tianqi Chen, and Beidi Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.361014Z"},"links":{"cited_paper":"/paper/2408.11049","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:7d878f89fb42fc371393862ec054ecb24a8e95a96350792e94fada49dacddc25","observation_id":"cad4fde1-361c-49c6-b4aa-03316ac2335f","resolution":{"observed_at":"2026-08-07T10:30:34.361014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-07-06T05:27:13.416519Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-07T10:30:34.366945Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer.arXiv preprint arXiv:1701.06538,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.366945Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:bd2e563349445052b94433e5d5c6a47f6b1850acf4c87c40c6759d584cb105a7","observation_id":"b8e7e5aa-9c34-4451-bf7a-0d520a1403d1","resolution":{"observed_at":"2026-08-07T10:30:34.366945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-07T10:30:34.371804Z","title":"Scaling llm test-time compute optimally can be more effective than scaling model parameters.arXiv preprint arXiv:2408.03314,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.371804Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:f66aad90e26042bcbeb2730329b3f03f4dc7925eb6bda6c2322b265566d6b7ee","observation_id":"644ba042-e62d-43e8-b36d-cda667cc8f7d","resolution":{"observed_at":"2026-08-07T10:30:34.371804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21465","last_updated":"2025-04-25T19:40:54Z","snapshot_observed_at":"2026-08-01T20:33:25.557711Z","submitted_at":"2024-10-28T19:08:12Z","title":"ShadowKV: KV Cache in Shadows for High-Throughput Long-Context LLM Inference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21465","snapshot_observed_at":"2026-08-07T10:30:34.376950Z","title":"16 Hanshi Sun, Li-Wen Chang, Wenlei Bao, Size Zheng, Ningxin Zheng, Xin Liu, Harry Dong, Yuejie Chi, and Beidi Chen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.376950Z"},"links":{"cited_paper":"/paper/2410.21465","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:66331427231fc09c54c365b08cde3584c6d240e5ae8309c57bad03f40097d8f5","observation_id":"2122038e-f8b7-4b8f-8ae8-c0b6172ef580","resolution":{"observed_at":"2026-08-07T10:30:34.376950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08524","last_updated":"2025-02-12T16:00:11Z","snapshot_observed_at":"2026-08-08T04:44:23.355074Z","submitted_at":"2025-02-12T16:00:11Z","title":"LLM Pretraining with Continuous Concepts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08524","snapshot_observed_at":"2026-08-07T10:30:34.382006Z","title":"Llm pretraining with continuous concepts.arXiv preprint arXiv:2502.08524,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.382006Z"},"links":{"cited_paper":"/paper/2502.08524","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:7e5c86f64250b1e7377294d99946e9ad48b58e6cdb6dfa69bac7c2061ee88201","observation_id":"1f9d6edd-9263-434b-b776-3b3437af8323","resolution":{"observed_at":"2026-08-07T10:30:34.382006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10774","last_updated":"2024-08-26T21:01:02Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-16T01:33:02Z","title":"Quest: Query-Aware Sparsity for Efficient Long-Context LLM Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10774","snapshot_observed_at":"2026-08-07T10:30:34.386755Z","title":"Quest: Query-aware sparsity for efficient long-context llm inference.arXiv preprint arXiv:2406.10774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.386755Z"},"links":{"cited_paper":"/paper/2406.10774","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:983fc52b0eb048bcf46c85624234312c60fdb9ac311fe17c9720b07f2683f942","observation_id":"8b93b88b-f13c-4dd1-a139-1f5daea7b325","resolution":{"observed_at":"2026-08-07T10:30:34.386755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10449","last_updated":"2025-09-09T04:52:25Z","snapshot_observed_at":"2026-08-07T16:05:47.222775Z","submitted_at":"2025-04-14T17:38:25Z","title":"M1: Towards Scalable Test-Time Compute with Mamba Reasoning Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10449","snapshot_observed_at":"2026-08-07T10:30:34.398504Z","title":"Rush, and Tri Dao","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.398504Z"},"links":{"cited_paper":"/paper/2504.10449","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:daf6b2292dc85982bc62a4c6421e7537583ad1fab291ee7b955b7bf83d3ddf6c","observation_id":"d6006ae1-8995-429c-99c8-0c3945142982","resolution":{"observed_at":"2026-08-07T10:30:34.398504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00724","last_updated":"2025-03-03T07:53:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-01T17:16:04Z","title":"Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00724","snapshot_observed_at":"2026-08-07T10:30:34.403798Z","title":"Inference scaling laws: An empirical analysis of compute-optimal inference for problem-solving with language models.arXiv preprint arXiv:2408.00724,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.403798Z"},"links":{"cited_paper":"/paper/2408.00724","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:e6dbd5fa423a460cecba88b00791c57f9b1104313697060189e89ae7752c1f61","observation_id":"7ba3c48d-c8c0-46ff-823f-a30d79e9b952","resolution":{"observed_at":"2026-08-07T10:30:34.403798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17453","last_updated":"2024-04-07T00:56:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-29T17:59:56Z","title":"Efficient Streaming Language Models with Attention Sinks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17453","snapshot_observed_at":"2026-08-07T10:30:34.409258Z","title":"Efficient streaming language models with attention sinks, 2024.https://arxiv.org/abs/2309.17453","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.409258Z"},"links":{"cited_paper":"/paper/2309.17453","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:478ee72185f3882179282a4ac52d872eb70667fa54b77a1ce8d5ada735d60f69","observation_id":"e73ac66e-3bca-4c1e-aa00-dc59004ac2fe","resolution":{"observed_at":"2026-08-07T10:30:34.409258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T10:30:34.414362Z","title":"Qwen2 technical report.arXiv preprint arXiv:2407.10671, 2024a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.414362Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:107023d1af60305e342532ec8d3f3b5f5dfbd05cfe53a42d59a08f852cf20822","observation_id":"b07c3763-8c89-4860-8531-e0bfb19271a4","resolution":{"observed_at":"2026-08-07T10:30:34.414362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T10:30:34.419331Z","title":"Shinn Yao, Jiaming Zhao, Dian Yu, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.419331Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:ab8d68f3d4594ff2097083d86e15c4c285dc1f63d4cb50f05752b345a2ab7667","observation_id":"13e7a974-fe98-4837-832b-e201e5be6bc5","resolution":{"observed_at":"2026-08-07T10:30:34.419331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11089","last_updated":"2025-02-27T09:01:21Z","snapshot_observed_at":"2026-08-07T14:17:15.942844Z","submitted_at":"2025-02-16T11:53:44Z","title":"Native Sparse Attention: Hardware-Aligned and Natively Trainable Sparse Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11089","snapshot_observed_at":"2026-08-07T10:30:34.424839Z","title":"ISBN 978-1-939133-28-1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.424839Z"},"links":{"cited_paper":"/paper/2502.11089","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:0823d1ccf62153ea0a56d17acb95ef8c4f0abad9c7b6598992661ae26689f48c","observation_id":"4c04b01e-0c77-456a-bba7-8938d89d8292","resolution":{"observed_at":"2026-08-07T10:30:34.424839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16363","last_updated":"2024-05-01T20:42:28Z","snapshot_observed_at":"2026-08-01T22:52:35.092898Z","submitted_at":"2024-02-26T07:33:05Z","title":"LLM Inference Unveiled: Survey and Roofline Model Insights","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16363","snapshot_observed_at":"2026-08-07T10:30:34.430496Z","title":"Llm inference unveiled: Survey and roofline model insights, 2024a.https://arxiv.org/abs/2402.16363","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.430496Z"},"links":{"cited_paper":"/paper/2402.16363","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:c804916ab5ea075410a778c8497ae3a6d1e5be7b6ffe89e2eef36b7a7d85b495","observation_id":"dcfdf893-6348-4cbd-95bc-e83b1ef50f6a","resolution":{"observed_at":"2026-08-07T10:30:34.430496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-07T10:30:34.435806Z","title":"Opt: Open pre-trained transformer language models.arXiv preprint arXiv:2205.01068,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.435806Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:13c880cb17fdca857feecdc9b04141abfe013e680283f805081a40bfbcc5b990","observation_id":"3ed5c8bc-4d41-4e67-944b-094d4c152d89","resolution":{"observed_at":"2026-08-07T10:30:34.435806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12757","last_updated":"2025-05-25T14:08:01Z","snapshot_observed_at":"2026-08-03T08:33:17.421277Z","submitted_at":"2024-08-22T23:00:40Z","title":"NanoFlow: Towards Optimal Large Language Model Serving Throughput","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12757","snapshot_observed_at":"2026-08-07T10:30:34.441416Z","title":"Nanoflow: Towards optimal large language model serving throughput.arXiv preprint arXiv:2408.12757,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.441416Z"},"links":{"cited_paper":"/paper/2408.12757","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:6061bb9b289cbb02bf72109cbbb898d2d55c2aff2b5787bc87335af0a2f92001","observation_id":"9636216e-aac4-4212-a1ed-e54d8b11d05d","resolution":{"observed_at":"2026-08-07T10:30:34.441416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.720747Z","title":"For the Qwen3 series, this additional overhead is bounded by 3.57% for the 0.6B model and by 1.56% for the 32B model","venue":null,"work_id":"93de9e7a-65da-4a64-99c6-fbd737398ee5","year":2024},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.446985Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:bec6cdd0a1bb1f048eda5cc43a0851f5fde64cef8366aa0a452ddbc9cc750a59","observation_id":"144903df-542b-4753-9db1-1e5b0d74243d","resolution":{"observed_at":"2026-08-07T10:30:35.726672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.703122Z","title":"LiveCodeBench features complex programming problems from recent coding contests, while AIME25 consists of challenging math problems","venue":null,"work_id":"2d156d2b-a2a5-40a9-b88b-22ff1c7089cb","year":2024},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.451857Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:ead080b58735eb74f638a4a17b1604151d2c0c326d1810208a1dd7da088a45e0","observation_id":"0f312401-9f31-4b72-a821-c92e42ddf92a","resolution":{"observed_at":"2026-08-07T10:30:35.708929Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.685184Z","title":"In parallel, approaches like FlashAttention (Dao et al., 2022; Dao,","venue":null,"work_id":"15162c94-2002-402e-80ed-c452b25884db","year":2022},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.457474Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:3f1b96203aee173c1051f203910fbc2521b89b6a3539edfaf8e8de9aaee12bff","observation_id":"cfb97397-1dab-46e5-9431-1a22820548a2","resolution":{"observed_at":"2026-08-07T10:30:35.691225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.667814Z","title":null,"venue":null,"work_id":"4f1a8122-b792-43bf-9dc9-c97f5b622588","year":2023},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.462492Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:38e62bb3ac3698c105724a350b72807072f224b0e2823a2b9f02c6560c91f221","observation_id":"f65f81ba-b263-4109-9fa5-77478e6f9397","resolution":{"observed_at":"2026-08-07T10:30:35.672934Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.651334Z","title":"Our analysis builds on the practical designs and implementations of these systems","venue":null,"work_id":"5d32e975-402c-4adf-87a2-4b28eeac7a6d","year":2023},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.468065Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:24cd5acb895bb738a05fc906e7a30b3d267327f101b338d5526d3f8a698ef804","observation_id":"63f381e5-9da3-44d9-97a1-9ea056c8ae3f","resolution":{"observed_at":"2026-08-07T10:30:35.657421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.632972Z","title":"Additionally, model compression and offloading (Dettmers et al., 2022; Lin et al., 29 2024a; Svirschevski et al., 2024; Sheng et al., 2023; Frantar et al.,","venue":null,"work_id":"34985795-b2ef-4cd9-be9a-20f7b23ecbc0","year":2022},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.472731Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:8c7225bf0773d455c3572d1a21e27e8203ba8760cb56c83b1cde82c07c9edc69","observation_id":"26519990-d61a-47b4-893f-a381711f8071","resolution":{"observed_at":"2026-08-07T10:30:35.638920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.616135Z","title":null,"venue":null,"work_id":"5f1441fd-a509-4939-930c-b1d7d937c2e9","year":2025},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.478097Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:67f73ccf90177433dcd8e94f84d2aea71e68d9185a529660bc7d486a90b767ef","observation_id":"485c0785-0d1c-4cba-bf9b-1950eb07c03e","resolution":{"observed_at":"2026-08-07T10:30:35.621091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.599131Z","title":"Efficient reward-model-based (Wu et al., 2024; Snell et al., 2024; Sun et al., 2024c) test-time scaling algorithms are also comprehensively studied","venue":null,"work_id":"61c03e3c-7854-4551-b4ea-787e37ab48a5","year":2024},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.483002Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:1fe0bbf07dd1adfdcb363be1ada65d635e8caa28fdfeb324c1fbe6c504e14b44","observation_id":"6afc88df-97f5-4a9d-bda0-c1a779b24991","resolution":{"observed_at":"2026-08-07T10:30:35.604606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:35.739791Z","title":"Nvidia blackwell platform: Advancing generative ai and accelerated computing","venue":null,"work_id":"d26243f1-2e9e-46f8-bfb3-ca987933fd99","year":2024},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":1996,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.392586Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:20abcc163b030479729476c766c5ba7468d4044998a199af673658dacb0a7767","observation_id":"90dada2a-a842-4645-8862-d9b62d8c81e1","resolution":{"observed_at":"2026-08-07T10:30:35.744729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.19393","last_updated":"2025-03-01T06:07:39Z","snapshot_observed_at":"2026-07-06T20:29:11.710285Z","submitted_at":"2025-01-31T18:48:08Z","title":"s1: Simple test-time scaling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.19393","snapshot_observed_at":"2026-08-07T10:30:34.327205Z","title":"s1: Simple test-time scaling.arXiv preprint arXiv:2501.19393,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.327205Z"},"links":{"cited_paper":"/paper/2501.19393","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:62417aeedbabe6bfcc7c96f43416116944a089e49ab677cae133f5bc894880aa","observation_id":"5c49558e-3fa6-4a63-8b8f-92ce35c12372","resolution":{"observed_at":"2026-08-07T10:30:34.327205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-07T11:26:24.987920Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-07T10:30:34.141313Z","title":"Rethinking attention with performers.arXiv preprint arXiv:2009.14794,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.141313Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:79decedb8eef12286abda090e52a00faba14f97fa23c5505d30ad0ce330d101f","observation_id":"557f2613-81ad-44b6-9090-c975746cc0df","resolution":{"observed_at":"2026-08-07T10:30:34.141313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-07T10:30:34.114066Z","title":"Large language monkeys: Scaling inference compute with repeated sampling.arXiv preprint arXiv:2407.21787,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.114066Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:a28536693c4835202fd5f8cc2351d8396c1ce4819eff7c96ab9987939030ef32","observation_id":"5de5f4a4-4bf0-4e26-9c4d-e303b78c1df2","resolution":{"observed_at":"2026-08-07T10:30:34.114066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.01318","last_updated":"2023-02-02T18:44:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-02T18:44:11Z","title":"Accelerating Large Language Model Decoding with Speculative Sampling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.01318","snapshot_observed_at":"2026-08-07T10:30:34.125280Z","title":"Accelerating large language model decoding with speculative sampling.arXiv preprint arXiv:2302.01318,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.125280Z"},"links":{"cited_paper":"/paper/2302.01318","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:35f2905a8065a1a5b091ab43474a851c9641e95e3b7e40159aba95690c163b73","observation_id":"f8106308-40c9-48c7-ab8e-97516f9a1067","resolution":{"observed_at":"2026-08-07T10:30:34.125280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.05315","last_updated":"2020-10-11T18:49:17Z","snapshot_observed_at":"2026-08-05T00:15:38.657357Z","submitted_at":"2020-10-11T18:49:17Z","title":"SMYRF: Efficient Attention using Asymmetric Clustering","version":1},"cited_work":{"arxiv_id":"2010.05315","doi":null,"metadata_source":"pith","pith_arxiv_id":"2010.05315","snapshot_observed_at":"2026-08-07T10:30:35.326006Z","title":"SMYRF: Efficient Attention using Asymmetric Clustering","venue":"cs.LG","work_id":"bacd280c-047a-45ef-83cc-fc1ad76361a7","year":2020},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.164977Z"},"links":{"cited_paper":"/paper/2010.05315","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:95f1ab8d75639e978ae76373b7385e474382ece33734956deb76a885ddc5e686","observation_id":"13201d32-6782-410b-ab1b-7664bb36fd8b","resolution":{"observed_at":"2026-08-07T10:30:35.334950Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01600","last_updated":"2025-03-08T05:23:57Z","snapshot_observed_at":"2026-07-06T20:30:26.881629Z","submitted_at":"2025-02-03T18:35:42Z","title":"Reinforcement Learning for Long-Horizon Interactive LLM Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01600","snapshot_observed_at":"2026-08-07T10:30:34.130495Z","title":"Reinforcement learning for long-horizon interactive llm agents.arXiv preprint arXiv:2502.01600, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.130495Z"},"links":{"cited_paper":"/paper/2502.01600","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:30d6f9f6546227b728e1efa2852eee1121f004e5769b395dbaaa8497f46a4792","observation_id":"e8e64e95-ca1d-49b7-bed5-f699951ef985","resolution":{"observed_at":"2026-08-07T10:30:34.130495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05317","last_updated":"2024-10-25T21:09:59Z","snapshot_observed_at":"2026-08-05T07:40:11.727051Z","submitted_at":"2024-06-08T01:35:11Z","title":"LoCoCo: Dropping In Convolutions for Long Context Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05317","snapshot_observed_at":"2026-08-07T10:30:34.119273Z","title":"Lococo: Dropping in convolutions for long context compression.arXiv preprint arXiv:2406.05317,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.119273Z"},"links":{"cited_paper":"/paper/2406.05317","citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:419674665a385046808d6d8426cb03848aaa28c837dac6bb0cdf5067a0ffa31d","observation_id":"7a14e433-d084-41a8-b1a7-a3f68645201e","resolution":{"observed_at":"2026-08-07T10:30:34.119273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:30:34.108187Z","title":"Daman Arora and Andrea Zanette","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T10:30:34.108187Z"},"links":{"citing_paper":"/paper/2506.05333"},"observation_digest":"sha256:d4d726b68022ed4fe605da35afe4cc6260f93f31dd839698439ebce9f05bd6dc","observation_id":"bf7534e3-9452-4d0e-8355-73f3ff28b719","resolution":{"observed_at":"2026-08-07T10:30:34.108187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.05333","last_updated":"2025-06-20T01:25:25Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T10:18:59.977399Z","submitted_at":"2025-06-05T17:59:24Z","title":"Kinetics: Rethinking Test-Time Scaling Laws"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":61,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 2 inbound Pith citation observations for arXiv:2506.05333."}