{"as_of":"2026-08-02T17:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ffc22246d44156961d19a44c48f65ffb82f11a5e3f1f281fb2b861441f78e85b","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T09:04:06.347354Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-02T06:30:47.504484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T12:47:01.373765Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.06125","snapshot_observed_at":"2026-08-01T12:47:01.373765Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26591","last_updated":"2026-07-29T08:13:12Z","snapshot_observed_at":"2026-08-01T23:27:54.385668Z","submitted_at":"2026-07-29T08:13:12Z","title":"MultiFixer: A Coordinator-Proposer Based Multi-Agent Framework For Fixing Multi-Hunk Bugs","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T12:47:01.373765Z"},"links":{"cited_paper":"/paper/2605.06125","citing_paper":"/paper/2607.26591"},"observation_digest":"sha256:f1385072278a16c6029b7b2d2ad96d660c1fcc32933e3af2fc5c81084980b466","observation_id":"549c5b4b-52d0-4b48-9297-33de4b6f62c9","resolution":{"observed_at":"2026-08-01T12:47:01.373765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.06125/citation-record","integrity":"/paper/2605.06125/integrity","json":"/paper/2605.06125/citation-record.json","paper":"/paper/2605.06125"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.02883","last_updated":"2024-12-03T22:38:05Z","snapshot_observed_at":"2026-07-06T20:01:14.493111Z","submitted_at":"2024-12-03T22:38:05Z","title":"TDD-Bench Verified: Can LLMs Generate Tests for Issues Before They Get Resolved?","version":1},"cited_work":{"arxiv_id":"2412.02883","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02883","snapshot_observed_at":"2026-07-05T09:10:52.106373Z","title":"TDD-Bench verified: Can LLMs generate tests for issues before they get resolved?arXiv preprint arXiv:2412.02883","venue":null,"work_id":"b0a18d84-bbf2-47a5-9c44-5e3812f07b46","year":2024},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2412.02883","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:6ba845ac3ca4fd828c376a16fd55e85ee247e844354b52443159020829a87912","observation_id":"c56448ec-fe67-4be4-b095-fed53ac09e85","resolution":{"observed_at":"2026-05-11T20:26:12.022865Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12952","last_updated":"2025-02-07T12:33:06Z","snapshot_observed_at":"2026-07-06T18:33:15.701836Z","submitted_at":"2024-06-18T14:54:37Z","title":"SWT-Bench: Testing and Validating Real-World Bug-Fixes with Code Agents","version":3},"cited_work":{"arxiv_id":"2406.12952","doi":"10.48550/arxiv.2406.12952","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12952","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Code agents are state of the art software testers","venue":null,"work_id":"f82ce16b-a3f7-49db-81b8-d272759cc9d7","year":2024},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2406.12952","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:b589cfc9460f21bdb5e76d1fc0f208f649ce4ef80c4844dc06f859457b4b9358","observation_id":"0325c06c-79f0-4450-b662-d01a85937647","resolution":{"observed_at":"2026-05-11T20:26:12.077714Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":"2512.02556","doi":"10.18653/v1/d18-1512","metadata_source":"pith","pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","venue":"cs.CL","work_id":"07c85cc5-4086-4abc-823b-6d0f4ff784d0","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:ad5cb89e578fe9aa8034108a6271fa8de7d5ec850ef0b669dffbc06cc7a17eb6","observation_id":"95194f36-9e8e-441c-991a-63883f4a566a","resolution":{"observed_at":"2026-05-11T20:26:12.004352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.16941","last_updated":"2025-11-14T22:00:03Z","snapshot_observed_at":"2026-07-06T22:30:21.881075Z","submitted_at":"2025-09-21T06:28:17Z","title":"SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?","version":2},"cited_work":{"arxiv_id":"2509.16941","doi":"10.48550/arxiv.2509.16941","metadata_source":"pith","pith_arxiv_id":"2509.16941","snapshot_observed_at":"2026-07-10T15:07:19.634552Z","title":"SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?","venue":"cs.SE","work_id":"a561c78a-4b02-4053-a92a-bc5c7c5f6b9b","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2509.16941","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:93e96871b81b635974d42f992768b808ad0d9f7d34f566fc66f308da95a23419","observation_id":"e5097a72-fd71-451d-b850-25b82c93f511","resolution":{"observed_at":"2026-05-12T13:48:53.849224Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:48.977196+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:48.977196+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":"2602.15763","doi":"10.48550/arxiv.2602.15763","metadata_source":"pith","pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-07-10T13:57:07.038585Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","venue":"cs.LG","work_id":"ad29b1a2-bf77-46b3-9ead-fb62b1d2c6fe","year":2026},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:6574a2374e4c06b2bb760d9927f39312ae0b8999144b525f16cb45bb559dcb89","observation_id":"e46be76a-84d0-46be-87f5-0fc62ff52bef","resolution":{"observed_at":"2026-05-11T20:26:12.010118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Just, R., Jalali, D., and Ernst, M","venue":null,"work_id":"3fe6d934-8c7e-428d-9e79-a881c7c11efa","year":2014},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:0f779e91f9f31773beb4fc8e0a908e46e66e6d75034b347e75dc10db44a48563","observation_id":"36d55959-6cc0-4892-bcbb-70d17e6c3419","resolution":{"observed_at":"2026-05-26T16:28:03.244773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":"2602.02276","doi":"10.48550/arxiv.2602.02276","metadata_source":"pith","pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Kimi K2.5: Visual Agentic Intelligence","venue":"cs.CL","work_id":"d690be8f-5d53-49b0-b1e7-79668eb8fcdb","year":2026},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:507fe095e6038607f4cfd825e618e205bbabbe9780947b28d6c68ee69e04fd2c","observation_id":"c58597ae-8aeb-4413-b338-28b08539beb4","resolution":{"observed_at":"2026-05-11T20:26:11.984427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:c41805f111cf66061c648eadd687aa6e61f27b11570f21e862e7c493b4b46e64","observation_id":"9ce0dc4d-c8a0-457e-9668-a9a46654f7be","resolution":{"observed_at":"2026-05-11T20:26:12.040198Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.18470","last_updated":"2026-04-04T09:52:04Z","snapshot_observed_at":"2026-07-30T13:30:43.108201Z","submitted_at":"2025-12-20T19:08:15Z","title":"SWE-EVO: Benchmarking Coding Agents in Long-Horizon Software Evolution Scenarios","version":5},"cited_work":{"arxiv_id":"2512.18470","doi":"10.48550/arxiv.2512.18470","metadata_source":"pith","pith_arxiv_id":"2512.18470","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"SWE-EVO: Benchmarking Coding Agents in Long-Horizon Software Evolution Scenarios","venue":"cs.SE","work_id":"4dc0b41e-24de-4bd4-8e7d-9dccefa116f8","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2512.18470","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:eb543ed46300e6fe1084e5c6ffe31e570e8ca52fb15fe32c3dcc5e939796071e","observation_id":"db750414-5a0e-476d-8032-6b5f0586f0f6","resolution":{"observed_at":"2026-05-11T20:26:12.030598Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01602","last_updated":"2024-01-03T08:13:55Z","snapshot_observed_at":"2026-07-06T17:11:09.611305Z","submitted_at":"2024-01-03T08:13:55Z","title":"Exotic Topological Phenomena in Chiral Superconducting States on Doped Quantum Spin Hall Insulators with Honeycomb Lattices","version":1},"cited_work":{"arxiv_id":"2401.01602","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.01602","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"R., and Ma, L","venue":null,"work_id":"f187e6aa-c5e7-4110-ab49-47b6787037e3","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2401.01602","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:5ce07d2289382af4f8be62426e597abd54eb31fbb6f65e07790d38ac70eb29d3","observation_id":"911de558-d813-44b2-9a25-b6b6c46b441b","resolution":{"observed_at":"2026-05-11T20:26:11.976093Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04966","last_updated":"2025-07-15T03:52:37Z","snapshot_observed_at":"2026-07-06T17:56:44.412445Z","submitted_at":"2024-04-07T14:08:28Z","title":"Advancing Code Coverage: Incorporating Program Analysis with Large Language Models","version":2},"cited_work":{"arxiv_id":"2404.04966","doi":"10.48550/arxiv.2404.04966","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.04966","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Enhancing llm-based test generation for hard-to-cover branches via program analysis.CoRR, abs/2404.04966","venue":null,"work_id":"76a2a410-21bc-4d13-8c7d-3d47837eccd1","year":2024},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"cited_paper":"/paper/2404.04966","citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:88e16f5ed693d072d0daab609414fe2252d9c2ca639fcc6a4f3beec7622cf76f","observation_id":"2ae7aeed-dde3-43fc-ad02-536464b3ff4d","resolution":{"observed_at":"2026-05-11T20:26:11.944425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.24419","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Unit test up- date through LLM-driven context collection and error- type-aware refinement.arXiv preprint arXiv:2509.24419","venue":null,"work_id":"3b49ec94-df1a-40d6-92e2-ef32fe54550b","year":2025},"citing_paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T09:04:06.347354Z"},"links":{"citing_paper":"/paper/2605.06125"},"observation_digest":"sha256:e4d882517eb6189bf9679f7a8089f84d8ed13e2ec3c04cc3f6a440c43b33a1b8","observation_id":"caa121fa-d441-4354-8d44-8ccb4580c19a","resolution":{"observed_at":"2026-05-11T20:26:11.962909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-02T06:30:47.504484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.06125","last_updated":"2026-05-07T12:31:09Z","latest_version":1,"primary_category":"cs.SE","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:31:09Z","title":"Breaking, Stale, or Missing? Benchmarking Coding Agents on Project-Level Test Evolution"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":0,"verified_exact":9,"verified_fuzzy":1},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-02T06:30:47.504484+00:00","source":"crossref"},{"observed_at":"2026-08-02T06:30:44.765945+00:00","source":"retraction_watch"}],"thesis":"As of 2 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 1 inbound Pith citation observation for arXiv:2605.06125."}