{"as_of":"2026-08-08T02:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:44ccd431a32fbd6a3ba1a041b6f61285b095dbb0ec163c3bf2851ee6a71ec5be","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":30,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:40:41.058314Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T14:40:41.058314Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18149","last_updated":"2025-05-23T17:57:43Z","snapshot_observed_at":"2026-08-07T14:32:34.233639Z","submitted_at":"2025-05-23T17:57:43Z","title":"First Finish Search: Efficient Test-Time Scaling in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:40:41.058314Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2505.18149"},"observation_digest":"sha256:62f2bc21cf1c701acd12ec7b0511c40a0c7ac54806f60e1acaed6b4618a50f01","observation_id":"1d51f9f6-71e7-4b35-8641-d17ab126bf7f","resolution":{"observed_at":"2026-08-07T14:40:41.058314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T12:35:42.308005Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24863","last_updated":"2025-05-30T17:58:36Z","snapshot_observed_at":"2026-08-07T20:38:56.380571Z","submitted_at":"2025-05-30T17:58:36Z","title":"AlphaOne: Reasoning Models Thinking Slow and Fast at Test Time","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.308005Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2505.24863"},"observation_digest":"sha256:c40da5cf954b36d5e523378ed1e70c9c036767a77e9a53854da406383952aa3d","observation_id":"4479646c-d535-474b-a217-90628cfbcd97","resolution":{"observed_at":"2026-08-07T12:35:42.308005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T12:02:43.485411Z","title":"S*: Test time scaling for code generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00845","last_updated":"2025-08-17T12:17:48Z","snapshot_observed_at":"2026-08-07T16:09:18.251031Z","submitted_at":"2025-06-01T05:39:56Z","title":"Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:02:43.485411Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2506.00845"},"observation_digest":"sha256:a2c54e7b9aee355ec8d168ae8b75370e9d6762232acfeb74e49589f7e14998c1","observation_id":"941ccb5e-2660-441f-974b-0760f30b506e","resolution":{"observed_at":"2026-08-07T12:02:43.485411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T10:18:59.138334Z","title":"S*: Test time scaling for code generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.05566","last_updated":"2025-07-15T21:44:21Z","snapshot_observed_at":"2026-08-08T01:05:35.040171Z","submitted_at":"2025-06-05T20:24:58Z","title":"ScaleRTL: Scaling LLMs with Reasoning Data and Test-Time Compute for Accurate RTL Code Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:59.138334Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2506.05566"},"observation_digest":"sha256:76215cca2ac33540205f9ba4e193242bdfcb58e95276c3d708c032d773114357","observation_id":"013f40b3-c033-419e-b65d-a3e2733194da","resolution":{"observed_at":"2026-08-07T10:18:59.138334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-07T05:18:37.098954Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.08311","last_updated":"2026-05-27T03:57:09Z","snapshot_observed_at":"2026-08-07T05:11:22.076864Z","submitted_at":"2025-06-10T00:41:54Z","title":"Understanding Automated Program Repair Agents Through the Lens of Traceability: An Empirical Study","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:18:37.098954Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2506.08311"},"observation_digest":"sha256:1f24b9470888b591b890c3dbaad4f2095b966658969ec1f525d9298b67ebeb7e","observation_id":"48efbcaf-ec31-42d7-91ec-08e02a006bee","resolution":{"observed_at":"2026-08-07T05:18:37.098954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-06T10:53:18.496007Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.23370","last_updated":"2025-07-31T09:37:22Z","snapshot_observed_at":"2026-08-06T17:11:43.504555Z","submitted_at":"2025-07-31T09:37:22Z","title":"Trae Agent: An LLM-based Agent for Software Engineering with Test-time Scaling","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:18.496007Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2507.23370"},"observation_digest":"sha256:cfb1b52217a2e79fad942361346226cda44ac1489696809d67a6ee258b93511e","observation_id":"39b54d1f-1873-4251-9da3-7b0285ef22ff","resolution":{"observed_at":"2026-08-06T10:53:18.496007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T20:17:09.862906Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10874","last_updated":"2025-08-14T17:46:01Z","snapshot_observed_at":"2026-08-06T03:19:32.559275Z","submitted_at":"2025-08-14T17:46:01Z","title":"SSRL: Self-Search Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T20:17:09.862906Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2508.10874"},"observation_digest":"sha256:4bf1899fa357bad610cc52de07086e68eba15fa9313a52499f3251e0f9193437","observation_id":"cae576c8-daad-4d64-87ee-56724e58b22c","resolution":{"observed_at":"2026-08-05T20:17:09.862906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-04T13:26:49.991171Z","title":"S*: Test time scaling for code generation.arXiv preprint arXiv:2502.14382, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.00501","last_updated":"2026-08-05T06:01:15Z","snapshot_observed_at":"2026-08-08T02:08:59.257244Z","submitted_at":"2025-10-01T04:33:53Z","title":"CodeChemist: Test-Time Scaling for Low-Resource Code Generation via Functional Knowledge Transfer","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T13:26:49.991171Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2510.00501"},"observation_digest":"sha256:7a12a72f8d6512d1c1aa3656c5848d47d9d3036cb36eaffa36cda2a0f6fb982c","observation_id":"dc82192f-1451-43bb-9bf0-f91e02c241b0","resolution":{"observed_at":"2026-08-04T13:26:49.991171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2511.16858","last_updated":"2026-04-03T16:15:46Z","snapshot_observed_at":"2026-07-06T22:36:35.545474Z","submitted_at":"2025-11-20T23:55:56Z","title":"Investigating Test Overfitting on SWE-bench","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-17T19:57:06.015270Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2511.16858"},"observation_digest":"sha256:e3c1702b5c850f94d3f09726804a59b92da3b62a38deeaf8142a15a3ff41d577","observation_id":"60105154-838c-4fa0-8809-38d795e310ca","resolution":{"observed_at":"2026-05-17T20:00:10.752156Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2512.14917","last_updated":"2026-04-23T22:42:11Z","snapshot_observed_at":"2026-07-31T07:00:51.587326Z","submitted_at":"2025-12-16T21:12:53Z","title":"Evaluating Code Reasoning Abilities of Large Language Models Under Real-World Settings","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-16T21:23:44.762007Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2512.14917"},"observation_digest":"sha256:7a443571fdb76194b62c9207ec1139641443e8f147e273db8b9f638369f552a7","observation_id":"e59f2cf1-0b7b-4366-be2c-eeb361f7d574","resolution":{"observed_at":"2026-05-16T21:28:34.161126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2603.27098","last_updated":"2026-04-04T02:18:57Z","snapshot_observed_at":"2026-08-02T12:17:19.632566Z","submitted_at":"2026-03-28T02:37:36Z","title":"Ensemble-Based Uncertainty Estimation for Code Correctness Estimation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T22:52:58.524934Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2603.27098"},"observation_digest":"sha256:31d1ea06bf2d09ce738897c9c90499524307f8faa268cbbc2b91cecfecaa3062","observation_id":"d95d7dcd-d1f6-45df-93ba-923fe35bc8ed","resolution":{"observed_at":"2026-05-14T22:53:14.064225Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.05560","last_updated":"2026-06-30T13:49:36Z","snapshot_observed_at":"2026-07-13T09:22:43.743786Z","submitted_at":"2026-04-07T08:00:54Z","title":"An Iterative Test-and-Repair Framework for Competitive Code Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T19:44:32.950977Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.05560"},"observation_digest":"sha256:0bc7d5711c449a13ae165b25b48b40ed0847bc0c29239b654e9fdd4b35298ef3","observation_id":"b3404d8c-9966-497f-bd29-24c2f5ffc91a","resolution":{"observed_at":"2026-05-10T22:35:48.594787Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-07-13T09:22:44.557413Z","title":"S*: Test time scaling for code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.05560","last_updated":"2026-06-30T13:49:36Z","snapshot_observed_at":"2026-07-13T09:22:43.743786Z","submitted_at":"2026-04-07T08:00:54Z","title":"An Iterative Test-and-Repair Framework for Competitive Code Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T09:22:44.557413Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.05560"},"observation_digest":"sha256:fb014ba2de9c62b4a43ff113548de5a3c7f836dcfe849b2a8327b773d0288ce2","observation_id":"a8236709-bcd5-484c-9158-da14c3020ab2","resolution":{"observed_at":"2026-07-13T09:22:44.557413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.05868","last_updated":"2026-04-07T13:28:09Z","snapshot_observed_at":"2026-08-02T07:08:59.060388Z","submitted_at":"2026-04-07T13:28:09Z","title":"Understanding Performance Gap Between Parallel and Sequential Sampling in Large Reasoning Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T18:36:01.200412Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.05868"},"observation_digest":"sha256:65cb6e254f4e036229c77b122bac4b0c61b0b4dd8b9f775ac5ef3ac32f14bfc1","observation_id":"ec0c04c0-b397-4a0d-9886-0f366c6fd68a","resolution":{"observed_at":"2026-05-11T00:20:52.512539Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.10449","last_updated":"2026-04-12T04:15:31Z","snapshot_observed_at":"2026-07-06T22:59:05.519456Z","submitted_at":"2026-04-12T04:15:31Z","title":"AdverMCTS: Combating Pseudo-Correctness in Code Generation via Adversarial Monte Carlo Tree Search","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-10T16:35:16.056397Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.10449"},"observation_digest":"sha256:aace06a2197f656f697acc491d941cdb155aa12848a77fd08788079004cd359e","observation_id":"d29b0de0-3ab9-4a04-a0c7-f33da9b39e87","resolution":{"observed_at":"2026-05-11T08:40:57.437957Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.16995","last_updated":"2026-04-18T13:49:47Z","snapshot_observed_at":"2026-07-06T23:04:10.324443Z","submitted_at":"2026-04-18T13:49:47Z","title":"SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-10T06:57:03.100519Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.16995"},"observation_digest":"sha256:5e6edb66ba997bd2f6a91fa6b6ba6c7f5cf9b221a8fa7a7688a7f718055218e8","observation_id":"084d5fc7-7dfe-47e3-8c35-eb9ec42f3423","resolution":{"observed_at":"2026-05-10T07:01:49.460726Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.17288","last_updated":"2026-04-19T07:04:49Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T07:04:49Z","title":"Clover: A Neural-Symbolic Agentic Harness with Stochastic Tree-of-Thoughts for Verified RTL Repair","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T06:09:39.737812Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.17288"},"observation_digest":"sha256:8316c2f50aa635aa53b590e1b1a1f387d958bca804422bd8775c46285d78483f","observation_id":"34561241-24a2-4335-a14e-5af913e23ef2","resolution":{"observed_at":"2026-05-10T06:11:20.104728Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2604.21598","last_updated":"2026-04-28T05:10:28Z","snapshot_observed_at":"2026-07-06T23:08:10.140279Z","submitted_at":"2026-04-23T12:21:03Z","title":"You Don't Need Public Tests to Generate Correct Code","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-09T20:57:43.802195Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2604.21598"},"observation_digest":"sha256:d93bb31cb0f0d67a22124185f185a4c80ece0e126c8be6f4d09d737d623691ed","observation_id":"8c7e349d-7471-4b50-b644-a51d94124d86","resolution":{"observed_at":"2026-05-09T20:58:06.503019Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.01194","last_updated":"2026-05-02T02:13:11Z","snapshot_observed_at":"2026-07-06T23:14:29.125042Z","submitted_at":"2026-05-02T02:13:11Z","title":"VLA-ATTC: Adaptive Test-Time Compute for VLA Models with Relative Action Critic Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-09T15:10:16.533927Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.01194"},"observation_digest":"sha256:2fca8b26f860e4af4350d3cdfca241ec6b1e15bbae5dc0928c1cc3a0668418e1","observation_id":"430b4b6e-b475-4e91-a67a-adec344410bc","resolution":{"observed_at":"2026-05-11T16:46:06.426908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.11299","last_updated":"2026-05-13T03:29:35Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-11T22:34:45Z","title":"Primal Generation, Dual Judgment: Self-Training from Test-Time Scaling","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-13T02:25:58.830629Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.11299"},"observation_digest":"sha256:edad67fc96bf39b35099b97262a0d2edd701f06ba49c3a7c6ad1cd509cc79cbe","observation_id":"11a23cf3-8394-4e6c-b64e-1fce1a319253","resolution":{"observed_at":"2026-05-13T02:27:07.012994Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.11299","last_updated":"2026-05-13T03:29:35Z","snapshot_observed_at":"2026-07-06T23:23:11.928199Z","submitted_at":"2026-05-11T22:34:45Z","title":"Primal Generation, Dual Judgment: Self-Training from Test-Time Scaling","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-14T20:46:38.558668Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.11299"},"observation_digest":"sha256:eecfd7b210a021f5f79ef0c51f416ce92b27cf41c9f429aea2ed45a8a895ed18","observation_id":"b89a0ac9-5bc9-476b-b632-ab8d0745da7d","resolution":{"observed_at":"2026-05-14T20:47:58.051554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.22478","last_updated":"2026-07-18T11:55:12Z","snapshot_observed_at":"2026-08-03T06:10:22.493856Z","submitted_at":"2026-05-21T13:36:38Z","title":"DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T06:40:58.445504Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.22478"},"observation_digest":"sha256:c87a048057ceddee24526d65f158d776e35b120fe2dcbd8b3377404f35f81004","observation_id":"33272c18-01b7-4bd6-9f6e-5423c1aa525a","resolution":{"observed_at":"2026-05-22T06:41:10.244507Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2605.22478","last_updated":"2026-07-18T11:55:12Z","snapshot_observed_at":"2026-08-03T06:10:22.493856Z","submitted_at":"2026-05-21T13:36:38Z","title":"DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-30T17:10:54.790735Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.22478"},"observation_digest":"sha256:7a11278c1ec6e208921b14b1db61452f3cbf9c327642b75f338fc955c908d6de","observation_id":"cc348fc7-c7ba-49bb-9976-a80e90665a51","resolution":{"observed_at":"2026-06-30T17:14:56.868345Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-02T13:28:23.927508Z","title":"S*: Test time scaling for code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.22478","last_updated":"2026-07-18T11:55:12Z","snapshot_observed_at":"2026-08-03T06:10:22.493856Z","submitted_at":"2026-05-21T13:36:38Z","title":"DeliCIR: Memory-Guided Test-Time Deliberation via Multi-Agent Collaboration for Composed Image Retrieval","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T13:28:23.927508Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2605.22478"},"observation_digest":"sha256:2ccd56763e9802d6c20da3d7d7eb6328bdfdb9d832b1cf33760d65b0d523e471","observation_id":"a967c520-5d39-4e31-9d46-f014212f8f3f","resolution":{"observed_at":"2026-08-02T13:28:23.927508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2606.03102","last_updated":"2026-06-02T03:42:04Z","snapshot_observed_at":"2026-08-03T04:21:57.609394Z","submitted_at":"2026-06-02T03:42:04Z","title":"Small RL Controller, Large Language Model: RL-Guided Adaptive Sampling for Test-Time Scaling","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-06-28T10:25:10.559953Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2606.03102"},"observation_digest":"sha256:863b4875df3b32b56cfb94da2d315c03cbf30c7bc246318f52cf81590ca55038","observation_id":"6070e180-aef8-41b1-8f17-4ae836593d6f","resolution":{"observed_at":"2026-07-02T02:56:29.979083Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2606.11052","last_updated":"2026-06-09T16:17:19Z","snapshot_observed_at":"2026-08-05T14:17:36.486236Z","submitted_at":"2026-06-09T16:17:19Z","title":"Attention Amnesia in Hybrid LLMs: When CoT Fine-Tuning Breaks Long-Range Recall, and How to Fix It","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-27T13:08:57.218711Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2606.11052"},"observation_digest":"sha256:bb696a512464ccfc2a24d6dc12828d9203778936b29300b39d551945ff28188c","observation_id":"c09ccd2d-ced5-46f3-9547-459607b3825c","resolution":{"observed_at":"2026-07-03T05:37:40.386138Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2606.17682","last_updated":"2026-06-16T08:48:58Z","snapshot_observed_at":"2026-08-01T05:53:08.805029Z","submitted_at":"2026-06-16T08:48:58Z","title":"From Trainee to Trainer: LLM-Designed Training Environment for RL with Multi-Agent Reasoning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-06-27T00:59:50.038405Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2606.17682"},"observation_digest":"sha256:cdad7791f3f8bcee97254ea6e74185c02655e6f392b470bbef5afac3b3809984","observation_id":"70039389-6f37-47db-a1d8-b85a68ea3bcd","resolution":{"observed_at":"2026-07-03T20:58:58.332792Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":"2502.14382","doi":"10.48550/arxiv.2502.14382","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"S*: Test time scaling for code generation","venue":"ArXiv.org","work_id":"b671edac-c05b-46dd-84a0-bad724e3222b","year":2025},"citing_paper":{"arxiv_id":"2606.27268","last_updated":"2026-06-25T16:50:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-25T16:50:21Z","title":"E-TTS: A New Embodied Test-Time Scaling Framework for Robotic Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-26T04:48:28.868562Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2606.27268"},"observation_digest":"sha256:46964a762b47e9a677cfa5c75f4aa9c662a77506ce92cc3609fb53ae22ff81f4","observation_id":"0cab6705-5cb2-4080-a953-dcf47cf963eb","resolution":{"observed_at":"2026-07-04T13:59:51.715906Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-07-13T01:18:48.061500Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08973","last_updated":"2026-07-09T22:34:00Z","snapshot_observed_at":"2026-08-07T22:15:33.720564Z","submitted_at":"2026-07-09T22:34:00Z","title":"SiFAR: Synchronization-Free All-Reduce for Low-Latency LLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T01:18:48.061500Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2607.08973"},"observation_digest":"sha256:0a4588ee45d40e92f6b53f2680c208f82ba10297d0b8e466f2d4f583e88cfb65","observation_id":"716ac33a-5f25-4f61-86be-23b70caba98e","resolution":{"observed_at":"2026-07-13T01:18:48.061500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14382","snapshot_observed_at":"2026-08-01T14:11:55.463382Z","title":"S*: Test time scaling for code generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18859","last_updated":"2026-07-21T08:49:30Z","snapshot_observed_at":"2026-08-07T03:37:18.882534Z","submitted_at":"2026-07-21T08:49:30Z","title":"PhoenixRepair: Rethinking Repair Strategy Exploration in Software Agents","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T14:11:55.463382Z"},"links":{"cited_paper":"/paper/2502.14382","citing_paper":"/paper/2607.18859"},"observation_digest":"sha256:38db70e164dd2d9d405a7f1605e42cc7c0edf4930772673ad4c6de84dc473cfd","observation_id":"cf445179-131f-4e19-b89d-5a56149ea7d0","resolution":{"observed_at":"2026-08-01T14:11:55.463382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.14382/citation-record","integrity":"/paper/2502.14382/integrity","json":"/paper/2502.14382/citation-record.json","paper":"/paper/2502.14382"},"outbound":[],"paper":{"arxiv_id":"2502.14382","last_updated":"2025-02-20T09:18:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T18:02:33.909462Z","submitted_at":"2025-02-20T09:18:53Z","title":"S*: Test Time Scaling for Code Generation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 30 inbound Pith citation observations for arXiv:2502.14382."}