{"as_of":"2026-08-04T20:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e3182203c48a27da4361779889e3373a831fbe0ee4507d20341c50f78a39e6ca","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T01:41:32.686349Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:01:21.515063Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.05922","snapshot_observed_at":"2026-07-11T17:59:28.201166Z","title":"arXiv preprint arXiv:2606.05922 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05458","last_updated":"2026-07-05T22:11:18Z","snapshot_observed_at":"2026-08-02T15:52:33.916749Z","submitted_at":"2026-07-05T22:11:18Z","title":"Learning to Control LLM Agent Harnesses with Offline Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-11T17:59:28.201166Z"},"links":{"cited_paper":"/paper/2606.05922","citing_paper":"/paper/2607.05458"},"observation_digest":"sha256:5bc2d52a0629fc28d7bc823fdc4459d7fee8f7317869e08bb4b3b47aafb77e9c","observation_id":"cd97c3a0-7275-4ffe-8e6e-69d66e708e9d","resolution":{"observed_at":"2026-07-11T17:59:28.201166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.05922","snapshot_observed_at":"2026-08-02T07:01:21.515063Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-02T18:46:00.066892Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:21.515063Z"},"links":{"cited_paper":"/paper/2606.05922","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:6fc73525f70d73d924df0ec0edd9aa80ce5cb8a825a055ed90129b9ec4c0d61a","observation_id":"75082944-7ea8-4635-a2f9-65ab8894e5ce","resolution":{"observed_at":"2026-08-02T07:01:21.515063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.05922","snapshot_observed_at":"2026-08-02T02:17:42.574447Z","title":"Evolving agents in the dark: Retro- spective harness optimization via self-preference, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14390","last_updated":"2026-07-15T22:06:59Z","snapshot_observed_at":"2026-08-03T15:17:03.850409Z","submitted_at":"2026-07-15T22:06:59Z","title":"Why Git Is the Memory Solution for the Agentic Development Lifecycle","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T02:17:42.574447Z"},"links":{"cited_paper":"/paper/2606.05922","citing_paper":"/paper/2607.14390"},"observation_digest":"sha256:71a516c72e5704e0a4c324df7de76aa9b0dd1cf358e78679efbc438bbcebf2af","observation_id":"7a06ea2b-ee63-443c-846c-5f6bdc34c492","resolution":{"observed_at":"2026-08-02T02:17:42.574447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.05922/citation-record","integrity":"/paper/2606.05922/integrity","json":"/paper/2606.05922/citation-record.json","paper":"/paper/2606.05922"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.16941","last_updated":"2025-11-14T22:00:03Z","snapshot_observed_at":"2026-07-06T22:30:21.881075Z","submitted_at":"2025-09-21T06:28:17Z","title":"SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?","version":2},"cited_work":{"arxiv_id":"2509.16941","doi":"10.48550/arxiv.2509.16941","metadata_source":"pith","pith_arxiv_id":"2509.16941","snapshot_observed_at":"2026-07-10T15:07:19.634552Z","title":"SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks?","venue":"cs.SE","work_id":"a561c78a-4b02-4053-a92a-bc5c7c5f6b9b","year":2025},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"cited_paper":"/paper/2509.16941","citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:510113d1e58b09006d3565fa3ba7506b2a91ddaee4decad55b0fb4c795fab676","observation_id":"ebdbb5be-f447-4acd-ab0e-212b6ac70a40","resolution":{"observed_at":"2026-07-02T12:56:57.375937Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-11T01:50:48.977196+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T01:50:48.977196+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13171","last_updated":"2025-04-17T17:59:25Z","snapshot_observed_at":"2026-07-06T21:11:05.749637Z","submitted_at":"2025-04-17T17:59:25Z","title":"Sleep-time Compute: Beyond Inference Scaling at Test-time","version":1},"cited_work":{"arxiv_id":"2504.13171","doi":"10.48550/arxiv.2504.13171","metadata_source":"pith","pith_arxiv_id":"2504.13171","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Gonzalez","venue":"cs.AI","work_id":"23cc5a62-758f-494f-83a7-b26f1a551c55","year":2025},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"cited_paper":"/paper/2504.13171","citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:10a9091dd3493d388167b5703020bdbdf62ac998c8b9cbd0ad87448ff15fe392","observation_id":"55465106-bec4-4720-b2aa-cf645776df6d","resolution":{"observed_at":"2026-07-02T12:56:57.372876Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08560","last_updated":"2024-02-12T18:59:46Z","snapshot_observed_at":"2026-08-03T06:31:15.541423Z","submitted_at":"2023-10-12T17:51:32Z","title":"MemGPT: Towards LLMs as Operating Systems","version":2},"cited_work":{"arxiv_id":"2310.08560","doi":"10.48550/arxiv.2310.08560","metadata_source":"pith","pith_arxiv_id":"2310.08560","snapshot_observed_at":"2026-07-11T03:47:48.199289Z","title":"MemGPT: Towards LLMs as Operating Systems","venue":"cs.AI","work_id":"2698f5ad-c84c-40ca-b839-0912dae10ba2","year":2023},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"cited_paper":"/paper/2310.08560","citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:62866877a663c85ed4a2871929c7ed3aebf6ca16f023c744e4b5ddfeeceb2c84","observation_id":"81bd0093-ad73-469f-b285-a91e5e428d88","resolution":{"observed_at":"2026-07-02T12:56:57.373071Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.543803+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.01782","last_updated":"2026-05-16T06:34:30Z","snapshot_observed_at":"2026-07-06T22:31:30.171287Z","submitted_at":"2025-10-02T08:20:36Z","title":"Can LLMs Refuse Questions They Do Not Know? Measuring Knowledge-Aware Refusal in Factual Tasks","version":2},"cited_work":{"arxiv_id":"2510.01782","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.01782","snapshot_observed_at":"2026-07-02T12:56:57.366096Z","title":"Can LLMs Refuse Questions They Do Not Know? Measuring Knowledge-Aware Refusal in Factual Tasks","venue":"cs.CL","work_id":"b243862d-b189-485e-9793-afd1490ee064","year":2025},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"cited_paper":"/paper/2510.01782","citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:65722f3aef92904de8e752a3e40129d3e67ca0d94d4f40ddfb0c8dec349b128d","observation_id":"c4b80b1b-cd54-4997-acac-9dfa8e35ff11","resolution":{"observed_at":"2026-07-02T12:56:57.367409Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:6e6936ca1888e29023ba963cd163f330477cdfc0dc9784bd21c61f8837a30dcf","observation_id":"fac77919-24f2-46e5-8b08-16280283123d","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:cd7e136facfa8b49644eed2e290abbf325ef9fbd43bf9eafddb642244496f437","observation_id":"2f14be69-7239-4561-aef7-71241ea69dc2","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"For code repair tasks, modify files directly under ,→task/repo/","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:6f902aba45d08788095c96112f4a1a8100a2efbfce83968de62342e7e1bdcede","observation_id":"76880001-5e73-4159-93bf-9097a5cf795b","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"difficulty","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:203340a3db19ce7dcd47ab4e3c8b9560b769271054bf4bc922efff0688c6744a","observation_id":"e51f5a6c-b4c3-427f-bb6f-7df3ad4e2475","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:f917dfa0de99f5846e23a8c70204a5b627d79ef8f098f8ba6e0f41119625b1c5","observation_id":"3c59a992-6b5b-4496-8865-35a44fec20e7","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:86af6dd2ab9b22174c64853a742437370dc7dd338e1286bce7d913f2b3af02bf","observation_id":"94a1f7a9-ae9a-4a5a-8ee8-7df56500492e","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:27a4259751a6f86aceab46d4d21131ddd58850edde35029c15a1fc2a6568be7c","observation_id":"73a0a751-dfc7-4979-8879-5073c75c5686","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"task_id\":","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:d4f220ea490317459391ddc17979b79a965c259c1cc960eb15d2f54a939c49ed","observation_id":"9781ba40-00df-4200-9db7-649fc391d526","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:80090f6d367f264684231f8153617075eb93cd0f0fc184320f0ac11fad3d7c43","observation_id":"f47b22d5-27a6-44f8-86cd-7fb95b9517cc","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"Higher severity means the diagnosis should influence optimization ,→more strongly","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:3d10241fe77ccdee425b12b9486441d3a7d11c187e6c2524dbc40cf301f3cbfd","observation_id":"75b0bd7e-5cb7-4114-ad05-237b82e7d95e","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:037ce8711d9f4a50419f964c758371a86db4bb8cfcb1639642e6fdd0a18f11fd","observation_id":"4456d7ec-93d4-4ee4-8610-f1fb4cf366a6","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:7e3cb6b1487438b6047eea52e719f27f3357e74d7ade89fe0caa78d6afc18385","observation_id":"c09d3f5a-306f-4279-b9d2-fbcb0f4c8b89","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:2f0b0afa24242d66e54fc804e65034d1ca55d48ad5823495e6fab965bd2afbe2","observation_id":"33e676f8-8f37-454a-80ec-6a6c0aaf0704","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"15 When done, send the changes and your rationale as your final message","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:ab98a7d6d9e1e2e5028d3a6c66ad917a3d42fb5c3828b8971cc25f366beb09aa","observation_id":"d215bdd0-fcd8-451d-8c9a-2960acb3694a","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:dadd038c69208f1ec5aaecb16f0309956889df8ec97e4add07e1f3224ee6bb7d","observation_id":"c983a1b6-c3e9-4872-9447-47d4bbe2879d","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"value\": <integer in [-10, 10]>,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:69ff9d15dfb063d56c44cfbb80f590cbc18820573ba98974cc715dc25a24aa73","observation_id":"17181835-c2a0-4f2e-ba15-2bb5967d65bc","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:3be121b30659fafc14c6bb91f3a9907b8877a5c1d51a21f7f4109211418dc75c","observation_id":"e4704a67-5568-4db0-9699-cbc5089d38ee","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:47e31c169d9492e369e91e971f8d779fb60da919325abb19e4df8fc707b1b3a2","observation_id":"f1bd639c-c7e6-4bed-86d7-d093df49e0fd","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:40cf83fedaa796d5e69046efd545a666f443460a1592fa73de9dc0dc578b1dd9","observation_id":"1756988e-2e4c-45c6-b1a3-7b4f6db6f3e5","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"Prefer adapting proven behavior over guessing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:14858b1d69c9f5b5e277e862d32bdc506050318cec1963b85c772f868ba8bafb","observation_id":"8245a833-48d1-4c09-b11c-75e37fb4c636","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"Follow stored data back to user-visible artifacts, config values back to their runtime representation, and wrappers back to the implementation that actually executes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:76d12dfda2811d7359068803d40bff2edd15e77b454a8cae733689241627502c","observation_id":"0d222104-32c3-41d8-91f0-f241bb727475","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"Keep generated files, caches, temporary smoke tests, and local environment output out of the submitted diff","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:3111eb36ffb6eed1bf31a81479afb699cacff7d865c6ec5d956b448982baa0fc","observation_id":"4c306f52-79b3-4610-896c-250126facfa0","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"Syntax checks are not enough: run at least one focused smoke that calls every new public route/function/method and covers each explicit failure/edge condition in the prompt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:734e89e75067e39d91dd2c8d1064402d2daa17266973d8da48ecf255def3420f","observation_id":"40993b36-6015-4c42-b52f-37cfc94ec7af","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"0\"‘ and ‘","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:d9aa8435be3690b14920e7c591e45ca9e73a533e10634310609eea177839db01","observation_id":"36346fe2-0b28-4529-b65d-751183dc660b","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:01cd8bd86daf09e43366c57bf525dfe107ce36d71f9908962db6317a632f3680","observation_id":"8f3ed524-facb-411e-8707-97efce58b87d","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"It avoids quoting failures and leaves a useful command trail in ,→‘/host-ws‘","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:bb4a62e3237e7b8db85650162b49289b45540af6dbc3ab467cb7bd6727889908","observation_id":"93b73c34-8847-42ac-802a-666af04295e1","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"Readable","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:6fb9cf2c41694cd0062213d94d99ebf32eef4f4fa8d6e5d64dbc2d0516df57cc","observation_id":"a7e8c3b6-2200-4a3f-80c6-b282b764639a","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"by ,→making queries","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:d816671281740cda514f2c631039f2a1c823ab7ac32a44cd128b448a4efd0833","observation_id":"08c43fb2-73ca-4388-8e5f-701ad6d8745f","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:a586986e8fafd2a5de1acadf4f146e89736d47b75880c0b885eb85e5d496be90","observation_id":"edec6ede-d5d3-4b0f-9252-f97164a65e0f","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"Avoid dumping the ,→full ‘are.py list‘ output unless the catalog is missing or corrupt","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:a42b890d63ba1b35db22d09c484115dd80488dd21c1aa73c4e8b1bb81b86d263","observation_id":"fe36f422-2f2e-4f91-ae4e-86a9617d682b","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"today\",","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:a3a2bb9eebcad6c24de7b2699fd8a3435f8c360939cc125db5c838bfd7e216ff","observation_id":"b322b816-c386-479b-8034-1b2eea1a4d26","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:60e6981377ce7ae64bda920a387a6a0215db58949da85e0f2862b0d0b59e662f","observation_id":"9d8dc803-ea5e-4e71-837f-85a15f6e51d3","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"Then email X that the cab was ordered","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:67e37852fa176f67b8003cfe46d5fe4c8ce7aba56bc84c7f668e3427a5634c3b","observation_id":"d6a5e2e7-96dc-426c-977e-18cea20325de","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:4b8c6c688d3b2f4f7a07812e319552406a2d65a51becae502f531d0b1fc6363e","observation_id":"902cb904-7aa3-488d-9eb7-96c77ef603a5","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:fc1d36696e5bbb46efe49eeb6944079eaa6ce25fc9eb256891756d4de1a7aa2b","observation_id":"c9c4054c-3c62-40ee-894d-e208319185f2","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"Complete unambiguous parts, report the ,→unresolved blocker to the user through AgentUserInterface, and do not ,→perform the ambiguous write","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:4de5029cb13361b69f922571074923535f1e1a0b6a084258668aa017b146318a","observation_id":"8edf3340-1e64-4429-986c-a4ef35ba9633","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T01:41:32.686349Z","title":"reply at 2024-10-15 ,→07:04:00; add to cart at 07:04:30","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T01:41:32.686349Z"},"links":{"citing_paper":"/paper/2606.05922"},"observation_digest":"sha256:4686d8b77f7ccb0ec889adee29e8ae685443150819f2a609afb6d3f437890ae5","observation_id":"6ea461d8-7b80-4086-b25d-1cf7e4655f05","resolution":{"observed_at":"2026-06-28T01:41:32.686349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.05922","last_updated":"2026-06-10T05:04:53Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-03T16:23:21.190194Z","submitted_at":"2026-06-04T09:26:00Z","title":"Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":2,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":35,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 3 inbound Pith citation observations for arXiv:2606.05922."}