{"as_of":"2026-08-08T07:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21333d00dac173d35c459024a0a7e3066a1f12b2feca4c8d515719134a0a9155","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:10:44.211578Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.10024/citation-record","integrity":"/paper/2508.10024/integrity","json":"/paper/2508.10024/citation-record.json","paper":"/paper/2508.10024"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.036760Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.036760Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:be9cc64fe907a2a38082f5ca5802328164dbd62be362debc57031225070a4d2b","observation_id":"344915d5-90d4-4c97-8f7a-ad7eab5c64f3","resolution":{"observed_at":"2026-08-05T23:10:44.036760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.042158Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.042158Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:5a7d3d71bf11abae464e09fcb90f2b58589cf5430645674026b5404b9dc4add8","observation_id":"4cdd9f5e-3667-41de-ac49-73db37f39acb","resolution":{"observed_at":"2026-08-05T23:10:44.042158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07279","last_updated":"2025-03-25T03:36:21Z","snapshot_observed_at":"2026-08-05T02:24:21.044775Z","submitted_at":"2024-11-11T18:59:45Z","title":"The Surprising Effectiveness of Test-Time Training for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07279","snapshot_observed_at":"2026-08-05T23:10:44.047194Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.047194Z"},"links":{"cited_paper":"/paper/2411.07279","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:d0b594fb65989b4ebee48ff30e00a8168fee9241737f4d67799ca9caa480056d","observation_id":"74ec1a39-c551-448f-9705-6d172b09a4a8","resolution":{"observed_at":"2026-08-05T23:10:44.047194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.054069Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.054069Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:3ee3046da051cabebfe1515e64431bf0b23871c1ed7773c080ae4f5cb15bfbe9","observation_id":"41961f94-23e3-470f-a6cb-897cab5012ae","resolution":{"observed_at":"2026-08-05T23:10:44.054069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.697369Z","title":null,"venue":null,"work_id":"faac6f62-9a54-43d5-8aa7-4df3f8dc4239","year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.058918Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:bc3f2e2e18287d11971442838576c54f1975987aba59254437094f57cf62d398","observation_id":"1c427908-7322-4bc7-9079-b23901ea2543","resolution":{"observed_at":"2026-08-05T23:10:44.702736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-05T23:10:44.063482Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.063482Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:4c59d006edfec6b9fdffc33ffd9dd1d7f35f8a0632de03fb996738e4e0148d99","observation_id":"374bac5d-5ab6-4735-8b88-ff6ea3cd00fc","resolution":{"observed_at":"2026-08-05T23:10:44.063482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.681413Z","title":null,"venue":null,"work_id":"a8ba07dd-3453-48a3-ad97-bd66d8c742a2","year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.069444Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:4b2f5dc59e37e165bacdbf3faf7a904b2e3cf049d28c2088a0f98fea61c7faa2","observation_id":"aa87b629-3953-4ff6-befa-cc90fce7a1ae","resolution":{"observed_at":"2026-08-05T23:10:44.686235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.665864Z","title":null,"venue":null,"work_id":"44857e59-2e39-40f4-85af-387e4e434f8e","year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.074648Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:b4de8df4e775d4a022c0d186a38b85f4c045456196200763bf73f1a34996a1f3","observation_id":"45d252b9-f008-4dd5-ac00-345b71793eaa","resolution":{"observed_at":"2026-08-05T23:10:44.670784Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.079840Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.079840Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:cf33ff6feac2d7252f13abedf8704c542ac8e77b96c4f809a9fa1b89b2616cd4","observation_id":"adacce55-2791-4850-adc4-f7fa011f5d3b","resolution":{"observed_at":"2026-08-05T23:10:44.079840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-05T23:10:44.084481Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.084481Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:f68b07eb284c5b18a41adbacb99393606585eb09d7c65c2aa3563129417c9117","observation_id":"7a79853e-abc5-46b8-bfb9-80275f57846f","resolution":{"observed_at":"2026-08-05T23:10:44.084481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T04:13:14.044604Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T23:10:44.089466Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.089466Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:6585e8f2bf4f4e75dc6061187964f03f4439259248958d7b9a14a0dca06686b8","observation_id":"561413b3-a232-4fcc-8d27-9377081c05bf","resolution":{"observed_at":"2026-08-05T23:10:44.089466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01547","last_updated":"2019-11-25T13:02:04Z","snapshot_observed_at":"2026-07-06T08:34:41.399203Z","submitted_at":"2019-11-05T00:31:38Z","title":"On the Measure of Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01547","snapshot_observed_at":"2026-08-05T23:10:44.095242Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.095242Z"},"links":{"cited_paper":"/paper/1911.01547","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:660f40ccb33d89815b6f8debb2d208b878bdf2d66f16288832a26bc0694e4e26","observation_id":"280230d6-64d4-4751-9c2f-a99e0b6d1ba4","resolution":{"observed_at":"2026-08-05T23:10:44.095242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08281","last_updated":"2025-10-23T09:36:08Z","snapshot_observed_at":"2026-07-31T05:45:37.385210Z","submitted_at":"2024-01-16T11:12:36Z","title":"The Faiss library","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08281","snapshot_observed_at":"2026-08-05T23:10:44.100337Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.100337Z"},"links":{"cited_paper":"/paper/2401.08281","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:086bac78a447cea4e7afc05cc71b71ce23814e548b8eab153e127c7ab6d62f51","observation_id":"61fe6d85-3a04-4131-a6e0-2d35eeb5bcd6","resolution":{"observed_at":"2026-08-05T23:10:44.100337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T23:10:44.105714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.105714Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:5cdd77151061020da391e31a7df042bce7a7d936fef8c21f34edaabea2b513c9","observation_id":"6c4af2d0-33d0-4aac-927e-b92620a18ed5","resolution":{"observed_at":"2026-08-05T23:10:44.105714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.110303Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.110303Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:ff2a1c2cff3a9324340709c671d13ff00b9b6a892ae80ed1c5b2273f34f6ae8a","observation_id":"8394fbf0-3247-44ac-93ea-b66b57dbb175","resolution":{"observed_at":"2026-08-05T23:10:44.110303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-05T23:10:44.115189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.115189Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:b415acaab0e29d807144a094e0be0a5648a6d3cf83d5e9870413135ea61d26c3","observation_id":"6a9ef5d0-148c-4d73-9895-b9929bc6699b","resolution":{"observed_at":"2026-08-05T23:10:44.115189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.639595Z","title":null,"venue":null,"work_id":"f2385d23-a385-4e78-a802-0f5cf7fac3c0","year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.120278Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:346e4539aeb2bfba74fad7ccc87aadbe11a64f4f2631fec85f8e00b6ff32bb8c","observation_id":"4b608b2f-4f65-4640-b2be-8747f7418d1f","resolution":{"observed_at":"2026-08-05T23:10:44.644380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.125039Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.125039Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:c24f473b9030ab4f3383d7bb1e55d25a637c7be3d3fc7ef380b831b7eea24555","observation_id":"b7a5bd36-2d30-4d68-8f12-4576f91a23b6","resolution":{"observed_at":"2026-08-05T23:10:44.125039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.08020","last_updated":"2025-02-08T19:39:09Z","snapshot_observed_at":"2026-08-05T18:26:21.204857Z","submitted_at":"2024-10-10T15:17:49Z","title":"Efficiently Learning at Test-Time: Active Fine-Tuning of LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.08020","snapshot_observed_at":"2026-08-05T23:10:44.130565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.130565Z"},"links":{"cited_paper":"/paper/2410.08020","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:85b7f3216960d2fa02d6d829ef8dff5b5802810f9897b5aca8c91364b541bfdf","observation_id":"2319e5b2-34e9-4b20-8b26-d2555df7a2b4","resolution":{"observed_at":"2026-08-05T23:10:44.130565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.613028Z","title":null,"venue":null,"work_id":"5aa782d3-1a5d-473f-b4d7-bf01b5c2d66d","year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.135827Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:75d984318da58c5b5daad22a1ac19118b51068b6e6f75c29a7a8fffb12a2ed84","observation_id":"01aab481-8d5b-478d-b45e-50ebd2aeac57","resolution":{"observed_at":"2026-08-05T23:10:44.617905Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T23:10:44.140230Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.140230Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:3ac52fb05fa1dbf678f26e8a619868fbc44ebb7ff60a395b50e06b6b09699f32","observation_id":"3ff0f3fd-709f-49a3-8e53-246a7ef8605a","resolution":{"observed_at":"2026-08-05T23:10:44.140230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.13081","last_updated":"2020-09-28T05:07:51Z","snapshot_observed_at":"2026-08-06T03:17:52.286711Z","submitted_at":"2020-09-28T05:07:51Z","title":"What Disease does this Patient Have? A Large-scale Open Domain Question Answering Dataset from Medical Exams","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.13081","snapshot_observed_at":"2026-08-05T23:10:44.144923Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.144923Z"},"links":{"cited_paper":"/paper/2009.13081","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:18f639179c23bf07ef4de9beaa7bf247cffb981293e8102cb3837c8cf825b1cd","observation_id":"0338bae2-1de3-4c39-bd0a-00e7cd4d9793","resolution":{"observed_at":"2026-08-05T23:10:44.144923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.597131Z","title":null,"venue":null,"work_id":"7651eb0f-f565-4004-b1cd-4836e33cc8d2","year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.149734Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:d7517ec5714d607ff3935e4c3b96bff48dc4ca7ce8ef3b609a198f50b55d54c1","observation_id":"449724e7-a8c7-41b9-8bfe-25836214166f","resolution":{"observed_at":"2026-08-05T23:10:44.602090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.155763Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.155763Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:8764c87f985bb8b6b60a4854c6babd7cb4eca8d4c6d38999d40170f8d3ea0d68","observation_id":"4669651b-1eec-430c-b9b6-03056f028a4f","resolution":{"observed_at":"2026-08-05T23:10:44.155763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19255","last_updated":"2024-07-02T03:46:03Z","snapshot_observed_at":"2026-08-06T12:10:50.595602Z","submitted_at":"2024-02-29T15:26:14Z","title":"GSM-Plus: A Comprehensive Benchmark for Evaluating the Robustness of LLMs as Mathematical Problem Solvers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19255","snapshot_observed_at":"2026-08-05T23:10:44.161130Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.161130Z"},"links":{"cited_paper":"/paper/2402.19255","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:3c76e17c7b23fa48edada4b185323fd24eebc3fe824c2540436defe3809b98ac","observation_id":"c26b4548-2955-4d1d-8e15-10a847931c94","resolution":{"observed_at":"2026-08-05T23:10:44.161130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01352","last_updated":"2026-03-02T20:56:17Z","snapshot_observed_at":"2026-08-04T07:18:25.941807Z","submitted_at":"2025-07-02T04:40:29Z","title":"Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01352","snapshot_observed_at":"2026-08-05T23:10:44.165790Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.165790Z"},"links":{"cited_paper":"/paper/2507.01352","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:814b2525ba8d1eeaa9cb22f2c395cdb0c71b8d728ac3c96dfde2cb5f12385145","observation_id":"3e5259e9-b824-4001-b121-ee36b189f5f2","resolution":{"observed_at":"2026-08-05T23:10:44.165790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14830","last_updated":"2024-02-16T23:44:38Z","snapshot_observed_at":"2026-08-01T01:16:04.260529Z","submitted_at":"2024-02-16T23:44:38Z","title":"Orca-Math: Unlocking the potential of SLMs in Grade School Math","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14830","snapshot_observed_at":"2026-08-05T23:10:44.171212Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.171212Z"},"links":{"cited_paper":"/paper/2402.14830","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:9093cb2d6ee4d6f379ffca9bc5e2d57826a04491f2af3698c385dbedab07a0aa","observation_id":"60d69caf-a079-4794-bd96-2a2dbf4cf237","resolution":{"observed_at":"2026-08-05T23:10:44.171212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.176132Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.176132Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:d3048d7966b81a0431bc9d601f796a7fb7b8fb6258960cfec065f8ab035c907f","observation_id":"2d153143-de86-4792-a0fe-fab93046c785","resolution":{"observed_at":"2026-08-05T23:10:44.176132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.181686Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.181686Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:fceda614b5a496a6d04c5ac4bd6bd2238dffdb54b870705362cd0e7262e3908e","observation_id":"fde28215-8457-4e8c-8fda-5c783ae2ae42","resolution":{"observed_at":"2026-08-05T23:10:44.181686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.550073Z","title":null,"venue":null,"work_id":"8b8b6cf4-5d95-48ed-ac64-fa9b05ec45bc","year":2020},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.187184Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:ce54fe2792a6b68e558339404e74f82d630e7c533f58f812d36068cdedd62cb6","observation_id":"17d7362f-12b2-48f1-992b-a8404646988d","resolution":{"observed_at":"2026-08-05T23:10:44.556132Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T23:10:44.191639Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.191639Z"},"links":{"citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:254aac4ff77524184b8649a014cea582d3aee72627063a11ab9ecad4a97b1b4e","observation_id":"b669ef56-685c-448f-a90a-6563c533875a","resolution":{"observed_at":"2026-08-05T23:10:44.191639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T23:10:44.196011Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.196011Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:444f0500df4c4cc1c108644ff5a6e19ac9a3d8a5d7b645ae6915e059f5b79144","observation_id":"bee500b3-d4f3-4958-b69a-c003a8ab1055","resolution":{"observed_at":"2026-08-05T23:10:44.196011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-05T23:10:44.201614Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.201614Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:09111a757099f1f8406cc9cb5108a6bdaa6dae15605e7ef0ac630d4e2cf5db4e","observation_id":"2c62a03b-ada0-4784-9116-5c54e452a17d","resolution":{"observed_at":"2026-08-05T23:10:44.201614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05176","last_updated":"2025-06-11T02:54:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-05T15:49:48Z","title":"Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05176","snapshot_observed_at":"2026-08-05T23:10:44.206752Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.206752Z"},"links":{"cited_paper":"/paper/2506.05176","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:fb103dfb32df21ffbe7a6a1fbf1cc0f8b8d388b4374166355fe7a91701ec9c86","observation_id":"f0daeea1-79bf-40f1-ac95-85ea06d2e06f","resolution":{"observed_at":"2026-08-05T23:10:44.206752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01933","last_updated":"2023-10-09T15:38:46Z","snapshot_observed_at":"2026-07-06T15:12:11.121128Z","submitted_at":"2023-04-04T16:31:37Z","title":"LLM-Adapters: An Adapter Family for Parameter-Efficient Fine-Tuning of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01933","snapshot_observed_at":"2026-08-05T23:10:44.211578Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T23:10:44.211578Z"},"links":{"cited_paper":"/paper/2304.01933","citing_paper":"/paper/2508.10024"},"observation_digest":"sha256:1f35925c9a23720939f1c562a1bb17e01f953ef25095980903edc1fb54107642","observation_id":"5d2400ab-5de5-4e47-ac6f-7ac799c3523a","resolution":{"observed_at":"2026-08-05T23:10:44.211578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.10024","last_updated":"2025-08-07T21:18:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T23:10:38.214506Z","submitted_at":"2025-08-07T21:18:52Z","title":"RTTC: Reward-Guided Collaborative Test-Time Compute"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2508.10024."}