{"as_of":"2026-08-18T19:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8043210feb1ed173a1dc3b14873483d89708673be70ec9d191e53eb9f63c8993","coverage":[{"denominator":4,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T07:58:33.233645Z","state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:09:06.907341Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T13:09:09.960532Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.29225","last_updated":"2026-05-28T01:25:37Z","snapshot_observed_at":"2026-08-15T20:30:12.777921Z","submitted_at":"2026-05-28T01:25:37Z","title":"BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29225","snapshot_observed_at":"2026-08-02T04:32:36.654936Z","title":"arXiv preprint arXiv:2605.29225 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13683","last_updated":"2026-07-15T10:26:26Z","snapshot_observed_at":"2026-08-17T02:01:40.814108Z","submitted_at":"2026-07-15T10:26:26Z","title":"Self-Evolving Agent Harnesses via Gated Semantic Quality-Diversity","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T04:32:36.654936Z"},"links":{"cited_paper":"/paper/2605.29225","citing_paper":"/paper/2607.13683"},"observation_digest":"sha256:20ec7850d8cc7a75af6b521dbbd91da2ada89946e12288bf8b433a37955e4f40","observation_id":"5497b8cc-5d59-430b-b115-f09d4d06fca9","resolution":{"observed_at":"2026-08-02T04:32:36.654936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29225","last_updated":"2026-05-28T01:25:37Z","snapshot_observed_at":"2026-08-15T20:30:12.777921Z","submitted_at":"2026-05-28T01:25:37Z","title":"BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents","version":1},"cited_work":{"arxiv_id":"2605.29225","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.29225","snapshot_observed_at":"2026-08-05T13:09:09.960532Z","title":"BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents","venue":"cs.AI","work_id":"492d2d63-a92e-4f91-b1e6-98361c1394d3","year":2026},"citing_paper":{"arxiv_id":"2608.03764","last_updated":"2026-08-04T14:51:56Z","snapshot_observed_at":"2026-08-13T17:52:56.118803Z","submitted_at":"2026-08-04T14:51:56Z","title":"GDPevo: Evaluating Agent Self-Evolution on Real Business Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:09:06.907341Z"},"links":{"cited_paper":"/paper/2605.29225","citing_paper":"/paper/2608.03764"},"observation_digest":"sha256:2b0519b73e3265fba6289a263ca1afaf82cae81abe8341bf04628bde609aabc6","observation_id":"0bff3dce-b501-4881-8b3c-7e55c52d112a","resolution":{"observed_at":"2026-08-05T13:09:10.035784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.29225/citation-record","integrity":"/paper/2605.29225/integrity","json":"/paper/2605.29225/citation-record.json","paper":"/paper/2605.29225"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.13220","last_updated":"2026-04-17T02:13:08Z","snapshot_observed_at":"2026-08-17T20:41:06.947506Z","submitted_at":"2025-10-15T07:16:28Z","title":"EvoTest: Evolutionary Test-Time Learning for Self-Improving Agentic Systems","version":2},"cited_work":{"arxiv_id":"2510.13220","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.13220","snapshot_observed_at":"2026-07-10T12:47:05.454413Z","title":"EvoTest: Evolutionary Test-Time Learning for Self-Improving Agentic Systems","venue":"cs.AI","work_id":"7bfa01a5-9660-494d-85b0-fadfb12d61fc","year":2025},"citing_paper":{"arxiv_id":"2605.29225","last_updated":"2026-05-28T01:25:37Z","snapshot_observed_at":"2026-08-15T20:30:12.777921Z","submitted_at":"2026-05-28T01:25:37Z","title":"BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T07:58:33.233645Z"},"links":{"cited_paper":"/paper/2510.13220","citing_paper":"/paper/2605.29225"},"observation_digest":"sha256:02171809a68b38c3d6939508212acb6fef9c99aaccad9354abaee51eac7c22ea","observation_id":"b660139c-767b-45b8-8ee3-244e8faa7a9a","resolution":{"observed_at":"2026-06-29T08:03:14.361422Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.15255","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T22:35:40.691030Z","title":"Richard Yu","venue":null,"work_id":"8c7dbcab-6e5e-4166-aecf-cf4e2ed3494e","year":2026},"citing_paper":{"arxiv_id":"2605.29225","last_updated":"2026-05-28T01:25:37Z","snapshot_observed_at":"2026-08-15T20:30:12.777921Z","submitted_at":"2026-05-28T01:25:37Z","title":"BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T07:58:33.233645Z"},"links":{"citing_paper":"/paper/2605.29225"},"observation_digest":"sha256:5cb0b9054a82369caa98c32d9e000d57959ca903835e09e42be2935e762812fc","observation_id":"4db135a9-b61f-4dde-b2f4-ea3f3bd0a4f1","resolution":{"observed_at":"2026-06-29T08:03:14.364485Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.29225","last_updated":"2026-05-28T01:25:37Z","snapshot_observed_at":"2026-08-15T20:30:12.777921Z","submitted_at":"2026-05-28T01:25:37Z","title":"BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T07:58:33.233645Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.29225"},"observation_digest":"sha256:28cdf0c46a6bc2f7cd6939fa61114e76725549f7588e643035d63b1e364f2924","observation_id":"f3fd099d-d42b-4f85-a67f-95804351bcd2","resolution":{"observed_at":"2026-06-29T08:03:14.358774Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T07:58:33.233645Z","title":"After examining, GET the object if possible, to add it to your inventory.3","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.29225","last_updated":"2026-05-28T01:25:37Z","snapshot_observed_at":"2026-08-15T20:30:12.777921Z","submitted_at":"2026-05-28T01:25:37Z","title":"BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T07:58:33.233645Z"},"links":{"citing_paper":"/paper/2605.29225"},"observation_digest":"sha256:a6ea520e3a2151f7321bde61df14ca3dab9ce25a76f9008ea924ec27b2bd4f1e","observation_id":"989a2a0e-a5ce-4f4c-ab6a-5b564d7939c5","resolution":{"observed_at":"2026-06-29T07:58:33.233645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.29225","last_updated":"2026-05-28T01:25:37Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T20:30:12.777921Z","submitted_at":"2026-05-28T01:25:37Z","title":"BenchTrace: A Benchmark for Testing Reflection Ability and Controlled Evolution in LLM Agents"},"reference_resolution":{"displayed":4,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":1,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":4},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 4 of 4 outbound references and 2 inbound Pith citation observations for arXiv:2605.29225."}