{"as_of":"2026-08-06T15:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d3c4ea61d871df12f634857becd182f8be4d1b76f52c609bad0cf18a1e9f6821","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T21:14:15.337979Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.18910/citation-record","integrity":"/paper/2606.18910/integrity","json":"/paper/2606.18910/citation-record.json","paper":"/paper/2606.18910"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:86a0dc8e4483a3dcaa75c6a2d36021054fd7985f65786b0ff99c72c9f86ab63f","observation_id":"f51958aa-3200-4e0b-9ff9-83d26e315bf3","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:82f90888e818c11124d4d333603e8a8ca5cdb5c57f0837d3acb611645190f076","observation_id":"e0e96048-3a30-42ac-a1b9-0f627e538fb8","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2022 , eprint=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:e69679ddecb931fb8a19dffaa0f61b3937650e2c6bd519bc0907ed339ae4e93e","observation_id":"3fae82db-53c2-49df-91f2-0de8144e9f2f","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:228570373fff68688f50af070d89e0dcb318fc398be9a652f1525f970c0df524","observation_id":"8595ac4a-6d67-45d2-80cf-5d8341c2c245","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:ba5386b2b8b953e8e8de5fdb8c722ba680e48986cad4fda1269c6e1905592431","observation_id":"4dcaefd4-35cd-4a78-9cdd-00df14222df4","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:e2d4211a1f011d47fdaa6636d1ecabc7d19df9f3d08842c1324eb98f58cce78e","observation_id":"be9463e4-796d-43d4-8f24-e89107e83ad8","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:15f7f24c748d994b889c4407caaf3f005e00c10fddfc81ee7baa50041b3dd986","observation_id":"d2ab4749-cf83-422f-9b23-43d8905282c6","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:d762acfbf895883aae764f32db5ae40723ab37f4d9714a4d5472608b07027037","observation_id":"7b1d4e2c-f9f2-437c-a863-fef31fc145b0","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:e5651634ad10d642bb61f994fa05d45dde7904e9da83e133570070a4ee3fa570","observation_id":"a8fa339c-d55f-404a-b753-c9f298028a8f","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:f258572cf32e269f0055ea13fa1783fbbd206f4ee3953b6a8afbc5e02b9823e9","observation_id":"41e31994-6a8d-445d-aa48-0739cc0ee7f5","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:aa485df737af71de8eef03bdf1e9d2a03c499150decb07388ff0aaf7f6ec876f","observation_id":"3fe7d86c-f535-426a-a449-ba03997d54f4","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:aa0d5d8b196e2df08d6e112748dd142d544fd37c22fa9bd1ee16f90efa49ce48","observation_id":"d2c9d9f5-3a8c-4464-b137-a1954272f03b","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:fcf908ad13a922070a6bdf4cfd7b8de99f97348a3512ab10d774f84896204dc3","observation_id":"9c52c9ac-41a4-4f1a-af89-024ee983ea13","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:67e65b5ade09022a827ca4a991461d385daaa1cfaa032ac439e1b990add3cc3d","observation_id":"5c9558dd-8566-4636-a1fc-137cc93c4e6f","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:c5442d9d3d659decb7ecc5e431e7fd2b2f0bac6bcbd6eab6347ada2a95f894b6","observation_id":"246c05c6-514c-4975-824c-5251d0ff9258","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:dddfa2bdfbc92c3963ad1f131d9ccbafbd856d864f139fcfd14c54fc3e2f02fc","observation_id":"a9cb60cf-198c-439c-8d5b-22dd7ed01e3e","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:58b175c2c5f0fcae5204c49bb1ae3ab7fd8776c2425e95533381fb46f8ae02e4","observation_id":"3cb19006-86cb-4c7c-b417-3ab063b85797","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:992d3f33ff88c4b710f9165f0b28a72c28e87c5cfbd721005f33294c5ca4624c","observation_id":"1b1c1a99-7f10-4a56-88ed-da0da936400a","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:6728f69a23833236147cd0b4d9230cf40970b0d6e2f4cea90df43c72ca859916","observation_id":"b4e19856-e7ed-4e9a-b843-e7b66aeef5d2","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:60ac569172ca46c27e79794b91f1ad97bc3db354a8a564abc8ca1829c4ff06cd","observation_id":"9f17bb48-b08d-4081-a675-2ac00e9f0374","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"Submitted to The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:e694e663b54dedd6b6c31a95b2c94ecbcee423f95993f5e77ecbf9b637a2dae6","observation_id":"ed1a1a14-5b4b-465b-8d31-ab093bcb668d","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:c14bc8b81b10299b9683808cbe864fcfb96f41259b4003f25f1e2ddca188629e","observation_id":"cbddd63c-4a9c-4aa0-9552-e0c5dfb66788","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:eebc369d07ee5919b7589a35a8809858a003add95de2c079f0383f2e81310e48","observation_id":"fef0ff2a-f3e1-4251-8548-d056c72cdc1c","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:eb51cc54c851eb8d837d923dce856a7680e342e83704b6d29f8b5d12fadf38cd","observation_id":"487174b9-bf9b-4d9e-afbb-8c3f2adc6dbe","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:e405a30c2c5db2d771739704bff11d4ad1a7878eb097ad9a01fb055b8830b33a","observation_id":"e2587c94-e6b6-446c-bf18-5f5200585835","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:409e871956247a70759865561e35f8f15fbe9472cc122dcf7af684c6b591974f","observation_id":"6402465b-bdfa-49d5-a139-d3e448be189d","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:5de7b5bbc0ec3797852b81a2604f81855be261b24610ed4783bdfdb4f7cce482","observation_id":"1199a4e1-fdb3-43d4-a96a-1732b169554a","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2016 , eprint=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:cba5b1d0fa703c68ab6dd5bd7b721aa0a706bafe939a3fce9a73afa8b700dd30","observation_id":"14cb3921-74cb-4a9f-877c-1594e0f37115","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:49c37db00e2d0515f62a4fee7b19b2e6f34e6812d758de0a2ef06fcd69c4255d","observation_id":"70bbf47e-a56b-41bc-9bf2-10f397296a0e","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:12af274d59fc54ba728df69b2c85b0b23e9e0bb2fa098dd85a9f2488284c321a","observation_id":"ac19e0be-fa2f-447a-bfc1-c6d9b643d980","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:9cf6f0d6256b6ca2555eb0ff2531e50b01ead8baec3937dc1d516e198cb92366","observation_id":"af52f997-0453-4092-82bf-110741bd819a","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:1e7d438e8a68b0419bbb5fa4b6f6f02ac7d554ee40f38916c1b7511185c52e83","observation_id":"77d1a2a3-a1c3-4a90-b599-e5f7fd2e86b3","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:8e33c8553ae45833be3502604c60b896a2520e47d72d83d89211a40d747b55d1","observation_id":"e908fd17-68d0-4967-a9be-c3eb9f31aaa8","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:54d400febe89319f870b5cc4636974f41924a285244b7cfd5c64cc9bad2af5fe","observation_id":"7dc7a94a-eafa-4605-a170-974976f09e87","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:20f892fd3e8d68b35e65fb8e333015fde16d63ea80d2ddb623f34a97f4e54ee5","observation_id":"b8e93f8b-4c72-4aa5-aa6d-908823bf736e","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:66cea75429085ab8d3dbfa921baa7d5ee4a1b52b8429c82b07961979b4f4c925","observation_id":"25e5ff54-b29a-43d0-84cf-547401b7c520","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T21:14:15.337979Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:e4d03feb64f34e4616572cbb9e0d612b62422c27a7b138146e7f19923475cdf6","observation_id":"8502b24c-7009-4e12-9215-758d8689ac08","resolution":{"observed_at":"2026-06-26T21:14:15.337979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10751","last_updated":"2025-08-14T15:34:47Z","snapshot_observed_at":"2026-08-05T20:21:02.654739Z","submitted_at":"2025-08-14T15:34:47Z","title":"Pass@k Training for Adaptively Balancing Exploration and Exploitation of Large Reasoning Models","version":1},"cited_work":{"arxiv_id":"2508.10751","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.10751","snapshot_observed_at":"2026-07-04T21:00:08.457909Z","title":"Pass@ k training for adaptively balancing exploration and exploitation of large reasoning models","venue":null,"work_id":"e7962a8e-fc74-4d96-9a1b-3c7897f6c60d","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2508.10751","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:9ce7504d16c78726317228edccb8045d663ab6922553ae48a070496ccb1a4ee4","observation_id":"31da5b42-3f07-437e-aab9-7e9d4d976486","resolution":{"observed_at":"2026-07-04T00:19:14.053289Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.15287","doi":"10.48550/arxiv.2412.15287","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Inference-aware fine-tuning for best-of-n sampling in large language models","venue":"arXiv (Cornell University)","work_id":"827ca722-7f31-4433-8fa9-e3b1596372cb","year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:e8a405fe5ef5798ca50ab0763f755124a5054f86c578ab1f592da6a3087032ac","observation_id":"23078f6b-1bc7-42d2-b39a-186889524162","resolution":{"observed_at":"2026-07-04T00:29:15.088693Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:61cbad9a7fe4718e8407d877867cbb322c24c7116b8985d84a596b0fe5f8bad4","observation_id":"94f73388-9f54-44fc-8300-9009dc9ecf75","resolution":{"observed_at":"2026-07-04T00:19:14.045185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15260","last_updated":"2025-08-21T05:48:38Z","snapshot_observed_at":"2026-08-02T03:10:09.020351Z","submitted_at":"2025-08-21T05:48:38Z","title":"Deep Think with Confidence","version":1},"cited_work":{"arxiv_id":"2508.15260","doi":"10.48550/arxiv.2508.15260","metadata_source":"pith","pith_arxiv_id":"2508.15260","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Deep Think with Confidence","venue":"cs.LG","work_id":"39c40c74-9f55-406d-b67a-37d9b88aa6b3","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2508.15260","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:4e4cf388cec1cfe094715c4e455ba474fc15c393473fe13cfa784d7094caa55a","observation_id":"314c5757-ac4f-4bfd-a8da-9809cd1b18d8","resolution":{"observed_at":"2026-07-04T00:29:15.109350Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.02864","last_updated":"2025-12-22T12:49:01Z","snapshot_observed_at":"2026-08-04T22:49:34.721171Z","submitted_at":"2025-11-03T16:04:07Z","title":"Mathematical exploration and discovery at scale","version":3},"cited_work":{"arxiv_id":"2511.02864","doi":"10.48550/arxiv.2511.02864","metadata_source":"pith","pith_arxiv_id":"2511.02864","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mathematical exploration and discovery at scale","venue":"cs.NE","work_id":"b3882729-74ba-4d80-9240-bfe03c45c33b","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2511.02864","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:cd263418a1d248a1b9a3419115a63450740a11b1e88eb7e1b17c6ba5693319b4","observation_id":"208c24e4-dc28-41da-9ae7-208ec38ad110","resolution":{"observed_at":"2026-07-04T00:29:15.086615Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.04412","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T19:20:06.671442Z","title":"Wider or deeper? scaling LLM inference-time compute with adaptive branching tree search","venue":null,"work_id":"1182a806-301c-441c-a957-cfb9788e0234","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:43c413cf2ec527452de85d32604b4e8bbe0e1fa9e42e6cb4aa7562b8dfe879b9","observation_id":"d9b33035-913e-490b-b57d-d3608d6534cd","resolution":{"observed_at":"2026-07-04T00:29:15.069865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20380","last_updated":"2025-06-27T15:47:52Z","snapshot_observed_at":"2026-07-06T20:43:55.138388Z","submitted_at":"2025-02-27T18:55:05Z","title":"Multi-Turn Code Generation Through Single-Step Rewards","version":2},"cited_work":{"arxiv_id":"2502.20380","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.20380","snapshot_observed_at":"2026-07-04T00:29:15.134963Z","title":"Multi-turn code generation through single-step rewards.arXiv preprint arXiv:2502.20380","venue":null,"work_id":"e79af7ea-7281-4c9c-964e-1aeb0ee620ae","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2502.20380","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:397eb051b83afbbbf74a468eb8f7af1847be5aa45b5916923b9aafb57a5acd40","observation_id":"1c592372-9c75-4d88-9e87-57660607199b","resolution":{"observed_at":"2026-07-04T00:29:15.137334Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":"2403.07974","doi":"10.1109/icsme52107.2021.00025","metadata_source":"pith","pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","venue":"cs.SE","work_id":"ea9e51ce-1e75-4182-92d8-4d25f70d2ee4","year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:a271bd769f441bb30b8aa23f13538ffdeb9c608dc3a50e883928793814090f23","observation_id":"83991a71-3760-491a-86d5-a8c026847a06","resolution":{"observed_at":"2026-07-04T00:19:14.042165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10406","last_updated":"2025-06-12T06:59:35Z","snapshot_observed_at":"2026-08-03T23:35:43.336278Z","submitted_at":"2025-06-12T06:59:35Z","title":"PAG: Multi-Turn Reinforced LLM Self-Correction with Policy as Generative Verifier","version":1},"cited_work":{"arxiv_id":"2506.10406","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10406","snapshot_observed_at":"2026-07-04T00:19:14.051927Z","title":"Pag: Multi-turn reinforced llm self-correction with policy as generative verifier","venue":null,"work_id":"3ece7f5e-2b9e-4bbb-8471-609033dbb283","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2506.10406","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:fa7759973b403d5183d6d970f19010604913eea91fd8e1d6f6b5c89e47250c77","observation_id":"c962156c-3135-434d-a787-c3dfe2abc0c3","resolution":{"observed_at":"2026-07-04T00:19:14.053615Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12917","last_updated":"2024-10-04T17:28:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-19T17:16:21Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2409.12917","doi":"10.48550/arxiv.2409.12917","metadata_source":"pith","pith_arxiv_id":"2409.12917","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Language Models to Self-Correct via Reinforcement Learning","venue":"cs.LG","work_id":"3ac87f3c-6dc4-492a-bbfb-8cdc05a15706","year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2409.12917","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:3aec0d3a610d16fabcbcce06278fbd0afb5297e30c7f3eba39a1d702f56a318c","observation_id":"79f2c3ef-4fe4-4a39-94a6-a4007f676944","resolution":{"observed_at":"2026-07-04T00:19:14.058624Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:38.810784+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:38.810784+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.19349","last_updated":"2025-09-17T17:49:02Z","snapshot_observed_at":"2026-08-04T18:42:43.786371Z","submitted_at":"2025-09-17T17:49:02Z","title":"ShinkaEvolve: Towards Open-Ended And Sample-Efficient Program Evolution","version":1},"cited_work":{"arxiv_id":"2509.19349","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.19349","snapshot_observed_at":"2026-07-04T20:00:08.586809Z","title":"ShinkaEvolve: Towards Open-Ended And Sample-Efficient Program Evolution","venue":"cs.CL","work_id":"41f30c7f-ee82-49b7-9ce9-463d3124269c","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2509.19349","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:f15cce321d2e6d268b29bdc563679fe8eb082a22c72381200059ac7b97dafe75","observation_id":"5df7c307-b6f2-46e9-a839-d06cb6d7a2c3","resolution":{"observed_at":"2026-07-04T00:19:14.061438Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14565","last_updated":"2025-07-15T06:30:11Z","snapshot_observed_at":"2026-08-06T10:51:40.967581Z","submitted_at":"2025-02-20T13:50:02Z","title":"ReVISE: Learning to Refine at Test-Time via Intrinsic Self-Verification","version":2},"cited_work":{"arxiv_id":"2502.14565","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14565","snapshot_observed_at":"2026-07-04T00:19:14.046607Z","title":"ReVISE: Learning to refine at test-time via intrinsic self-verification.arXiv preprint arXiv:2502.14565","venue":null,"work_id":"80b6b3d5-b525-4e88-89bc-38e7653a7a2a","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2502.14565","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:fe6129aecfc70541fc6c5b7d64493662eee8f37dab09a68674235be6b786297a","observation_id":"74e281c9-fde4-47db-afbd-fec6e3d423d9","resolution":{"observed_at":"2026-07-04T00:19:14.048377Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09891","last_updated":"2025-01-17T00:41:44Z","snapshot_observed_at":"2026-07-06T20:22:14.764479Z","submitted_at":"2025-01-17T00:41:44Z","title":"Evolving Deeper LLM Thinking","version":1},"cited_work":{"arxiv_id":"2501.09891","doi":"10.48550/arxiv.2501.09891","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.09891","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evolving deeper llm thinking","venue":"ArXiv.org","work_id":"0d63d5b8-90db-4ac8-b3f5-9f362a4411db","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2501.09891","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:74882c16f7dd2b757cc377a405b73f6d1d1b6c7dca6c37d7c488efd6cf8f31fc","observation_id":"222563d4-5153-4c40-b509-3ee67fc29166","resolution":{"observed_at":"2026-07-04T00:29:15.047216Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.16552","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T00:29:15.156723Z","title":"LANPO: bootstrapping language and numerical feedback for reinforcement learning in llms.CoRR, abs/2510.16552","venue":null,"work_id":"1b568ca0-a23a-40eb-b9ab-8c5fca1d089b","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:a5b1458ec2fb31e3858909beb573b66ade81462fa7402e9003b36d5758cee1cf","observation_id":"6c5567fd-e907-4377-8e0b-f28df8a25956","resolution":{"observed_at":"2026-07-04T00:29:15.160003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.15771","last_updated":"2025-05-29T05:35:57Z","snapshot_observed_at":"2026-07-06T20:40:39.302105Z","submitted_at":"2025-02-16T11:05:27Z","title":"Learning to Reason from Feedback at Test-Time","version":2},"cited_work":{"arxiv_id":"2502.15771","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.15771","snapshot_observed_at":"2026-07-04T00:29:15.129783Z","title":"Learning to reason from feedback at test-time, 2025 b","venue":null,"work_id":"589edd49-76db-494e-ba73-8cc270198d56","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2502.15771","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:9d3673503faedb85f5b30a796c530d85cae0cf2b2023033f9b576c54a8fda843","observation_id":"9bf4d8bd-33c8-4144-8676-a162f707424b","resolution":{"observed_at":"2026-07-04T00:29:15.134256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1126/science.abq1158","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mankowitz, Esme Sutherland Robson, Pushmeet Kohli, Nando De Freitas, Koray Kavukcuoglu, and Oriol Vinyals","venue":"Science","work_id":"cc452f34-3d34-41ff-9206-8edad6625ce6","year":2022},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:bec0ab4ace3a9f70e3691cc95678d6f9380d027c2f5ede9fc4934194a01e0431","observation_id":"5d767052-3297-481e-95c3-333cd65197b8","resolution":{"observed_at":"2026-06-26T21:20:02.665695Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:23.512078+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:23.512078+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08989","last_updated":"2025-06-10T17:02:00Z","snapshot_observed_at":"2026-08-05T17:21:43.718773Z","submitted_at":"2025-06-10T17:02:00Z","title":"SwS: Self-aware Weakness-driven Problem Synthesis in Reinforcement Learning for LLM Reasoning","version":1},"cited_work":{"arxiv_id":"2506.08989","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.08989","snapshot_observed_at":"2026-07-10T18:17:33.758346Z","title":"Sws: Self-aware weakness-driven problem synthesis in reinforcement learning for llm reasoning","venue":"cs.LG","work_id":"854e597e-b1de-46bc-95a4-225bb2ccab26","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2506.08989","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:9443228567e5c12352d1f6935bc8190bd0b994e1d30bdde6176239c67405dca1","observation_id":"1240ba79-4253-49fc-98b1-5c45025dfec3","resolution":{"observed_at":"2026-07-04T00:29:15.126478Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":"2303.17651","doi":"10.1007/s10664-008-","metadata_source":"pith","pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","venue":"cs.CL","work_id":"59181e7f-e58e-45d3-8146-4477a9f53d5a","year":2023},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:37075b9f5360b448829e64e72e892bc042df12ef1d53a69f1e6e779cc274a06b","observation_id":"01a8373c-80a6-4d32-b675-814a7b15b9b3","resolution":{"observed_at":"2026-07-04T00:29:15.099690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13131","last_updated":"2025-06-16T06:37:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-16T06:37:18Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","version":1},"cited_work":{"arxiv_id":"2506.13131","doi":"10.1016/j.shpsa.2017.03.005","metadata_source":"pith","pith_arxiv_id":"2506.13131","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AlphaEvolve: A coding agent for scientific and algorithmic discovery","venue":"cs.AI","work_id":"76a0f850-d490-4e4f-ab98-8d25df82cd23","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2506.13131","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:ec140787ee4f88b08a0c7658cd70e808740ed204112fae8fcf004472fc171421","observation_id":"61668bc3-3bff-4330-8358-2df9e8e16fa9","resolution":{"observed_at":"2026-07-04T00:19:14.050758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":"2203.02155","doi":"10.1007/s00354-022-00198-8","metadata_source":"pith","pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training language models to follow instructions with human feedback","venue":"cs.CL","work_id":"52aff42f-4fa9-4fcf-bdb3-1459b9bebf65","year":2022},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:3bbfe0730b174f94702774fb7caf829d3c7285e5a2755fa6b6392bac655a26c1","observation_id":"7a9c360b-70c7-4168-9311-080823dff210","resolution":{"observed_at":"2026-07-04T00:19:14.056204Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18219","last_updated":"2024-07-26T17:50:27Z","snapshot_observed_at":"2026-07-06T18:51:58.623293Z","submitted_at":"2024-07-25T17:35:59Z","title":"Recursive Introspection: Teaching Language Model Agents How to Self-Improve","version":2},"cited_work":{"arxiv_id":"2407.18219","doi":"10.48550/arxiv.2407.18219","metadata_source":"pith","pith_arxiv_id":"2407.18219","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Recursive introspection: Teaching language model agents how to self-improve","venue":"cs.LG","work_id":"1b29a5c4-1809-42c9-a008-9080646e27e1","year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2407.18219","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:5f4d9ac295c5ee5a2d1babc8c418dca68bc2b076e2b5a21c8fbea57fc4e1fa6a","observation_id":"fa184ade-a2ea-48ea-b930-884804feb4b3","resolution":{"observed_at":"2026-07-04T00:19:14.056710Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:39.539028+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:39.539028+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.18779","doi":"10.48550/arxiv.2601.18779","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pope: Learning to reason on hard problems via privileged on-policy exploration","venue":"arXiv (Cornell University)","work_id":"49d6a516-37ca-4bd7-8174-20b4b69db931","year":2026},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:7542e64e60f0978191cc836b2c52c23108a1c7e2e4b875a886103d3fc5e64c2a","observation_id":"e004a82a-5c91-4ed9-aee3-eb5682d6b86b","resolution":{"observed_at":"2026-07-04T00:29:15.138649Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11366","last_updated":"2023-10-10T05:21:45Z","snapshot_observed_at":"2026-07-06T15:05:53.556198Z","submitted_at":"2023-03-20T18:08:50Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","version":4},"cited_work":{"arxiv_id":"2303.11366","doi":"10.1109/cvpr42600.2020","metadata_source":"pith","pith_arxiv_id":"2303.11366","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reflexion: Language Agents with Verbal Reinforcement Learning","venue":"cs.AI","work_id":"778f739e-5f55-4961-8a2a-e4736a2757f4","year":2023},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2303.11366","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:769330f22b06a69925cd0bde931a713eea7a2e0c6755f46abfba47a9494742d4","observation_id":"a429f62c-a908-4a71-a99a-8f9df1361164","resolution":{"observed_at":"2026-07-04T00:29:15.168681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.24760","doi":"10.48550/arxiv.2505.24760","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Reasoning gym: Reasoning environments for reinforcement learning with verifiable rewards.arXiv preprint arXiv:2505.24760","venue":"ArXiv.org","work_id":"dfc22a2c-1b8e-4318-a044-e142c0608571","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:dd49f82fd381efbcde09b70a08e1bc9b9f4e0160e381652188beaf1e70bc15ab","observation_id":"98dcadcf-3920-4286-ac3c-fba0756cab4c","resolution":{"observed_at":"2026-07-04T00:29:15.132646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19595","last_updated":"2025-08-17T21:21:08Z","snapshot_observed_at":"2026-07-06T20:58:23.695292Z","submitted_at":"2025-03-25T12:21:26Z","title":"Optimizing Language Models for Inference Time Objectives using Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2503.19595","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.19595","snapshot_observed_at":"2026-07-04T10:49:46.153282Z","title":"Optimizing language models for inference time objectives using reinforcement learning.arXiv preprint arXiv:2503.19595","venue":null,"work_id":"34d6ecab-e139-48b3-83be-df2b136c6188","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2503.19595","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:831e5ab97a80d11133b2f28f77507f5b78782f7688d3263914c2d11ff06ffc5d","observation_id":"21aa595f-745b-4e8d-88c1-dd996626182f","resolution":{"observed_at":"2026-07-04T00:29:15.155048Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15201","last_updated":"2026-06-10T06:51:36Z","snapshot_observed_at":"2026-07-06T21:27:37.409259Z","submitted_at":"2025-05-21T07:26:36Z","title":"Pass@K Policy Optimization: Solving Harder Reinforcement Learning Problems","version":5},"cited_work":{"arxiv_id":"2505.15201","doi":"10.48550/arxiv.2505.15201","metadata_source":"pith","pith_arxiv_id":"2505.15201","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Pass@ k policy optimization: Solving harder reinforcement learning problems","venue":"cs.LG","work_id":"89595483-89ea-4826-91ac-09421f814681","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2505.15201","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:6cc0dd24b429577f04fb4e338afa453d7490d08cec85fc420c08f57cc4d56d05","observation_id":"736adcad-b70c-433e-acfc-9c72ebcb36fa","resolution":{"observed_at":"2026-07-04T00:29:15.146328Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:53:19.113534+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:53:19.113534+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":"2203.11171","doi":"10.1101/2025.04.03.646459","metadata_source":"pith","pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","venue":"cs.CL","work_id":"8c6d5a6b-b5cc-4105-9c84-9c34bb9375bb","year":2022},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:fdcd9959b951d00eaaef58a7d823f1c034fd4ff475839162a95584b7b4fa06f3","observation_id":"4965bfe8-612e-4b0d-9dab-3661d418fd1b","resolution":{"observed_at":"2026-07-04T00:29:15.150568Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T18:52:42.88633+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.23473","last_updated":"2025-11-28T18:58:14Z","snapshot_observed_at":"2026-08-04T17:31:45.294646Z","submitted_at":"2025-11-28T18:58:14Z","title":"ThetaEvolve: Test-time Learning on Open Problems","version":1},"cited_work":{"arxiv_id":"2511.23473","doi":"10.48550/arxiv.2511.23473","metadata_source":"pith","pith_arxiv_id":"2511.23473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ThetaEvolve: Test-time Learning on Open Problems","venue":"cs.LG","work_id":"0c9ee4af-c6aa-47e7-b1cc-863823529ecb","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2511.23473","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:2f93c3f955fe19cc4ab578474bdaaabffa0bc6859559e1bf1384ae635cd4fc37","observation_id":"6e7e1082-ea2f-4086-bae0-fa34e413ac75","resolution":{"observed_at":"2026-07-04T00:29:15.151400Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01622","last_updated":"2024-10-23T15:02:57Z","snapshot_observed_at":"2026-08-03T17:10:32.264100Z","submitted_at":"2024-02-02T18:39:51Z","title":"TravelPlanner: A Benchmark for Real-World Planning with Language Agents","version":4},"cited_work":{"arxiv_id":"2402.01622","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.01622","snapshot_observed_at":"2026-07-04T09:59:45.572230Z","title":"Travelplanner: A benchmark for real-world planning with language agents","venue":null,"work_id":"0cdaf974-0c0f-40ba-a494-df547f664899","year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2402.01622","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:0b2c815f11cbea249faff467ec6379b50479b3ad1971ff83d4f490c691ca14d5","observation_id":"75da41b7-fb71-44be-8ac9-8baa282f61c6","resolution":{"observed_at":"2026-07-04T00:29:15.117250Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02392","last_updated":"2025-02-27T22:10:16Z","snapshot_observed_at":"2026-08-02T09:51:41.216056Z","submitted_at":"2024-09-04T02:41:04Z","title":"Building Math Agents with Multi-Turn Iterative Preference Learning","version":2},"cited_work":{"arxiv_id":"2409.02392","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.02392","snapshot_observed_at":"2026-07-04T00:29:15.139325Z","title":"Building math agents with multi-turn iterative preference learning","venue":null,"work_id":"99ebe657-d196-4d8c-a03b-8aa4c20c27af","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2409.02392","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:4715ab715aa3192874878ac832c25feda3ac0f8e59e479dd13cabc22ab887217","observation_id":"5ee25b76-35cb-4735-947c-3663b87fcf69","resolution":{"observed_at":"2026-07-04T00:29:15.141867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:81fb80fcce548d71808a157e07d3fbfc0f773d5522c08ffc84a740f511f85a4a","observation_id":"b8e64b63-8925-4d29-942c-f2ef99f6c761","resolution":{"observed_at":"2026-07-04T00:29:15.122453Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:25e8f413efec56ecc9b2e485c2b97316da17e535b8c26c3176d3cbb10b8a4af5","observation_id":"2adec3eb-a2e9-4dfe-83ef-3bba0f7cb20b","resolution":{"observed_at":"2026-07-04T00:29:15.147097Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16175","last_updated":"2026-02-05T18:03:03Z","snapshot_observed_at":"2026-08-01T10:41:29.420510Z","submitted_at":"2026-01-22T18:24:00Z","title":"Learning to Discover at Test Time","version":2},"cited_work":{"arxiv_id":"2601.16175","doi":"10.18653/v1/2025.findings-emnlp.691","metadata_source":"pith","pith_arxiv_id":"2601.16175","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning to Discover at Test Time","venue":"cs.LG","work_id":"e6d32375-24bd-4c3a-a7b8-fe20121f31b1","year":2026},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2601.16175","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:d2b27e848b80da5f36f1cc2dca3cdf49eb91706bf874f9673c8c7e5cadfd4f99","observation_id":"59d8e74b-ac7a-47e3-93c5-7d7bba170778","resolution":{"observed_at":"2026-07-04T00:29:15.164130Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03106","last_updated":"2026-06-06T08:11:21Z","snapshot_observed_at":"2026-07-06T21:35:56.582332Z","submitted_at":"2025-06-03T17:39:02Z","title":"Critique-GRPO: Advancing LLM Reasoning with Natural Language and Numerical Feedback","version":7},"cited_work":{"arxiv_id":"2506.03106","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03106","snapshot_observed_at":"2026-07-04T00:29:15.119817Z","title":"Critique-grpo: Advancing llm reasoning with natural language and numerical feedback","venue":"cs.CL","work_id":"162d9cd7-aaa3-4c80-b5d0-3d38a404c421","year":2025},"citing_paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-06-26T21:14:15.337979Z"},"links":{"cited_paper":"/paper/2506.03106","citing_paper":"/paper/2606.18910"},"observation_digest":"sha256:b59523ca84f148142a1d1eac4ba82a9be2728ed1f09058ab9c5ac32c859d1f5e","observation_id":"5fe53e6d-5bfa-441c-8a6d-0c93514215e6","resolution":{"observed_at":"2026-07-04T00:29:15.122126Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.18910","last_updated":"2026-06-17T10:37:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-02T21:25:42.997753Z","submitted_at":"2026-06-17T10:37:23Z","title":"REVES: REvision and VErification--Augmented Training for Test-Time Scaling"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":34,"verified_fuzzy":0},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2606.18910."}