{"as_of":"2026-08-05T07:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a6b6d8f9fdb23ebeddbc176a2edfb82aaeb23ef7624fcaeabc53768b88d59910","coverage":[{"denominator":296,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T10:54:54.558241Z","state":"measured"},{"denominator":120,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":120,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":20,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:56:56.444199Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2605.26112","last_updated":"2026-05-25T17:59:36Z","snapshot_observed_at":"2026-07-06T23:36:01.564747Z","submitted_at":"2026-05-25T17:59:36Z","title":"From Model Scaling to System Scaling: Scaling the Harness in Agentic AI","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T21:29:57.326718Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2605.26112"},"observation_digest":"sha256:4530b307512d72cf970e6a53f65ea56882cf3e23835cec5471278a311a02c372","observation_id":"543c0465-a3c1-499b-acca-de62847597bd","resolution":{"observed_at":"2026-06-29T21:33:59.180180Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2605.27328","last_updated":"2026-05-26T17:36:48Z","snapshot_observed_at":"2026-08-02T23:52:56.176897Z","submitted_at":"2026-05-26T17:36:48Z","title":"Governed Evolution of Agent Runtimes through Executable Operational Cognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T15:49:39.678818Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2605.27328"},"observation_digest":"sha256:9368ad96ceec792c9eddd9d51074fa531de3cf8ceac4994492883eab48478938","observation_id":"b83a842c-ce63-41e1-bea1-200fbac12a7a","resolution":{"observed_at":"2026-06-29T16:33:39.506560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2606.03005","last_updated":"2026-06-02T01:24:30Z","snapshot_observed_at":"2026-08-04T20:14:57.624898Z","submitted_at":"2026-06-02T01:24:30Z","title":"MUSE: A Unified Agentic Harness for MLLMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T11:14:31.395762Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2606.03005"},"observation_digest":"sha256:f5f7e980a6be10fcb3a65d765c8926e229874073d554de1871be7a0a477c1767","observation_id":"163d4fea-7154-4d55-a967-6a8794ef4e99","resolution":{"observed_at":"2026-07-02T02:06:26.907703Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2606.09174","last_updated":"2026-06-10T04:07:30Z","snapshot_observed_at":"2026-08-02T21:47:09.761121Z","submitted_at":"2026-06-08T08:09:27Z","title":"Demonstrating chart-plot: Closing the Last Mile of Academic Chart Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T15:24:11.732604Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2606.09174"},"observation_digest":"sha256:4b35fbd825c3e8e92a792914537d3ca26756f04dc5160a27465a9da4c28b8dab","observation_id":"37a210ea-144e-4043-920c-2b74351bd361","resolution":{"observed_at":"2026-07-03T03:17:35.441560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2606.09774","last_updated":"2026-06-25T18:32:21Z","snapshot_observed_at":"2026-07-06T23:49:03.237958Z","submitted_at":"2026-06-08T17:35:17Z","title":"Auto-Configuring Scientific Simulators with Lightweight Coding-Agent Adapters","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-27T16:14:26.278017Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2606.09774"},"observation_digest":"sha256:fdb95a7997d5a50f9a6ffdcd39c965ff1419eefa3704162aa9a4127d9bf83bbf","observation_id":"1a77d76a-9f9f-45c3-a950-ec7affbeedbf","resolution":{"observed_at":"2026-07-03T01:47:32.168690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2606.09774","last_updated":"2026-06-25T18:32:21Z","snapshot_observed_at":"2026-07-06T23:49:03.237958Z","submitted_at":"2026-06-08T17:35:17Z","title":"Auto-Configuring Scientific Simulators with Lightweight Coding-Agent Adapters","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-29T05:25:29.078764Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2606.09774"},"observation_digest":"sha256:582a0f8d23f606b051c102cc4bf3384f3d76936f7005f78ac48bdaec0c926a27","observation_id":"3d9192c8-1b7d-4d33-a1eb-bc3afe6a125e","resolution":{"observed_at":"2026-06-29T15:23:33.007008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2606.12195","last_updated":"2026-06-10T15:17:08Z","snapshot_observed_at":"2026-08-01T02:09:41.655807Z","submitted_at":"2026-06-10T15:17:08Z","title":"InternVideo3: Agentify Foundation Models with Multimodal Contextual Reasoning","version":1},"reference_index":294,"source":"arxiv_source","source_observed_at":"2026-06-27T09:48:27.652901Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2606.12195"},"observation_digest":"sha256:a9544e9846727b8e6c5edc724c090772ee22d369e5d1fb74c44f064ab7cf6ce8","observation_id":"b39faff1-2770-4520-9313-9923e81dd4d6","resolution":{"observed_at":"2026-07-03T10:48:03.216826Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2606.20683","last_updated":"2026-06-14T05:40:16Z","snapshot_observed_at":"2026-07-30T16:44:18.366904Z","submitted_at":"2026-06-14T05:40:16Z","title":"From Question Answering to Task Completion: A Survey on Agent System and Harness Design","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-27T04:40:30.985824Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2606.20683"},"observation_digest":"sha256:d0db85f8a3fa12d4e8d45d575b94f0763185692339740ae77b2488e42dc28690","observation_id":"3e80f71d-1931-439a-aa86-1564d9108f4e","resolution":{"observed_at":"2026-07-03T16:58:43.795053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2606.24311","last_updated":"2026-06-23T08:44:00Z","snapshot_observed_at":"2026-08-02T22:05:19.090016Z","submitted_at":"2026-06-23T08:44:00Z","title":"LemonHarness Technical Report","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-26T00:06:14.275732Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2606.24311"},"observation_digest":"sha256:5b33e2c63d4515eb62c8397fd246932978ff811755dd2eb3ea59240d4d2d227b","observation_id":"91a37ffd-e715-4d02-939f-3a1b62af9523","resolution":{"observed_at":"2026-07-04T16:59:57.820928Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-07-12T06:39:21.435864Z","title":"arXiv preprint arXiv:2605.18747 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02846","last_updated":"2026-07-03T00:49:45Z","snapshot_observed_at":"2026-07-12T06:39:18.607161Z","submitted_at":"2026-07-03T00:49:45Z","title":"Object-Centric Environment Modeling for Agentic Tasks","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-12T06:39:21.435864Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.02846"},"observation_digest":"sha256:4d073c7dc79f5f95aafc9a3262b5a0987a4241ea3a769b5d1492baaf05b3e886","observation_id":"e9a64945-820c-4806-a882-bfddecab129d","resolution":{"observed_at":"2026-07-12T06:39:21.435864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-07-12T02:24:07.555850Z","title":"Code as agent harness.arXiv preprint arXiv:2605.18747, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.03451","last_updated":"2026-07-03T16:07:06Z","snapshot_observed_at":"2026-08-01T04:10:19.400296Z","submitted_at":"2026-07-03T16:07:06Z","title":"SkillOpt-Lite: Better and Faster Agent Self-evolution via One Line of Vibe","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-12T02:24:07.555850Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.03451"},"observation_digest":"sha256:be8d8d7deb3681671098a296f0fcdd56ad6f122ed22b52685b62be2d8097f7e9","observation_id":"eeb623de-5b40-4ab5-a451-093061820f8d","resolution":{"observed_at":"2026-07-12T02:24:07.555850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2607.06636","last_updated":"2026-07-07T14:11:00Z","snapshot_observed_at":"2026-08-04T01:02:40.145437Z","submitted_at":"2026-07-07T14:11:00Z","title":"Specification Grounding Drives Test Effectiveness for LLM Code","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-11T00:51:00.099499Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.06636"},"observation_digest":"sha256:af908e5b55975d87602c73ef03c9b7e5db86d99bd7f39827173fc0730e94cf86","observation_id":"4feb195b-af34-4dce-86cf-ab60336b8493","resolution":{"observed_at":"2026-07-11T00:57:42.254847Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":"2605.18747","doi":"10.48550/arxiv.2605.18747","metadata_source":"pith","pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Code as Agent Harness","venue":"cs.CL","work_id":"37bdf317-af61-48e1-9225-d6e14b264a37","year":2026},"citing_paper":{"arxiv_id":"2607.08028","last_updated":"2026-07-09T01:08:33Z","snapshot_observed_at":"2026-08-04T22:32:24.450032Z","submitted_at":"2026-07-09T01:08:33Z","title":"From Prompts to Contracts: Harness Engineering for Auditable Enterprise LLM Agents","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-10T13:27:21.622491Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.08028"},"observation_digest":"sha256:1279faf398389b95a22db81b51646f87d302bd14d1075f51205bc71f51037f21","observation_id":"a1fc3914-58f9-4a6f-b21e-78b7d3297255","resolution":{"observed_at":"2026-07-10T13:37:06.769204Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-02T07:56:56.444199Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08448","last_updated":"2026-07-15T16:40:12Z","snapshot_observed_at":"2026-08-04T18:37:38.875340Z","submitted_at":"2026-07-09T13:08:54Z","title":"Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T07:56:56.444199Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.08448"},"observation_digest":"sha256:28c30233487d57a2ea738f3a8b9503a3412199b0f7d05c98cb18d6ff644a1970","observation_id":"7ab4e873-02e3-4344-a9be-66f9c7667ec2","resolution":{"observed_at":"2026-08-02T07:56:56.444199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-02T07:01:21.354832Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13083","last_updated":"2026-07-13T10:14:15Z","snapshot_observed_at":"2026-08-02T18:46:00.066892Z","submitted_at":"2026-07-13T10:14:15Z","title":"Phantom Guardrails: When Self-Improving Agent Harnesses Fix Failures That Never Happened","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T07:01:21.354832Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.13083"},"observation_digest":"sha256:c9bebfd6268a34d8f11727cab7516458d1b77823e9c7f43402742b41a18ab174","observation_id":"949024c6-0e48-453d-b1ed-46b951b70c33","resolution":{"observed_at":"2026-08-02T07:01:21.354832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-02T05:40:35.236585Z","title":"Code as agent harness.arXiv preprint arXiv:2605.18747, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.13285","last_updated":"2026-07-14T21:39:55Z","snapshot_observed_at":"2026-08-02T05:40:31.513144Z","submitted_at":"2026-07-14T21:39:55Z","title":"Harness Handbook: Making Evolving Agent Harnesses Readable,Navigable, and Editable","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T05:40:35.236585Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.13285"},"observation_digest":"sha256:1816c0ae17f1a6a8935494aa86ced57acef50a47a0daf9758d504a795f9c3611","observation_id":"ae345547-85e7-4b64-9eb2-88a74682de38","resolution":{"observed_at":"2026-08-02T05:40:35.236585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-01T23:46:32.129876Z","title":"arXiv preprint arXiv:2605.18747 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15257","last_updated":"2026-07-16T17:51:23Z","snapshot_observed_at":"2026-08-01T23:46:03.181562Z","submitted_at":"2026-07-16T17:51:23Z","title":"SearchOS-V1: Towards Robust Open-Domain Information-Seeking Agent Collaboration","version":1},"reference_index":161,"source":"arxiv_source","source_observed_at":"2026-08-01T23:46:32.129876Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.15257"},"observation_digest":"sha256:af573f9949fd03e51fa5282b1b28c370638c984da63bd928f2c25809a260be69","observation_id":"1c0ebe3a-87c4-4c67-8e6e-68caf91b03b4","resolution":{"observed_at":"2026-08-01T23:46:32.129876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-01T15:40:10.984866Z","title":"arXiv preprint arXiv:2605.18747 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18235","last_updated":"2026-07-20T17:59:37Z","snapshot_observed_at":"2026-08-01T15:39:55.274131Z","submitted_at":"2026-07-20T17:59:37Z","title":"Automated Discovery Has No Universally Superior Harness","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-01T15:40:10.984866Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.18235"},"observation_digest":"sha256:12a768a41e512caeecfdf4bb2849c4b4a23174dbd896087d65b8c1972815dad8","observation_id":"b15ba22c-add5-4e9b-bcce-dee4c29d3e5c","resolution":{"observed_at":"2026-08-01T15:40:10.984866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-01T09:39:44.391575Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20709","last_updated":"2026-07-22T20:25:55Z","snapshot_observed_at":"2026-08-03T06:14:31.246388Z","submitted_at":"2026-07-22T20:25:55Z","title":"NVIDIA-labs OO Agents: Native Python Object-Oriented Agents","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T09:39:44.391575Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.20709"},"observation_digest":"sha256:dcc35d7aba106498529352e586c65fe5c52a0f5bc1b3799476e3cd7f36f6f3ef","observation_id":"01f1e563-e73e-492b-8520-ea0ee5174c6f","resolution":{"observed_at":"2026-08-01T09:39:44.391575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.18747","snapshot_observed_at":"2026-08-01T06:27:57.645038Z","title":"Code as Agent Harness","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.21909","last_updated":"2026-07-24T02:30:50Z","snapshot_observed_at":"2026-08-03T13:37:33.390033Z","submitted_at":"2026-07-24T02:30:50Z","title":"Claim Plane: Enforceable Change Intents and Dynamic Scope for Parallel Coding Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T06:27:57.645038Z"},"links":{"cited_paper":"/paper/2605.18747","citing_paper":"/paper/2607.21909"},"observation_digest":"sha256:5ea57f88bb4c385578e22bc42bcb2428ae2894daf5b9057bb0c91073749a0101","observation_id":"807a3351-0c6a-4460-9eb2-d48aad9f7700","resolution":{"observed_at":"2026-08-01T06:27:57.645038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.18747/citation-record","integrity":"/paper/2605.18747/integrity","json":"/paper/2605.18747/citation-record.json","paper":"/paper/2605.18747"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:57fe4eae4d82723172e15b1d17b90e0782fb985e776d1e1e561da5bbc1ebde04","observation_id":"72865078-2dc3-421a-b770-a968e68bde9b","resolution":{"observed_at":"2026-05-20T10:58:14.593029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:dab138238ca3ccd97f127ee2cdbcb55c0f2d51f66fc0b2ff4aefcd32c2579b23","observation_id":"565bde0e-5fac-41cc-bca9-333ea88c7674","resolution":{"observed_at":"2026-05-20T10:58:14.598577Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13474","last_updated":"2023-02-27T21:26:48Z","snapshot_observed_at":"2026-07-06T12:52:16.992962Z","submitted_at":"2022-03-25T06:55:15Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","version":5},"cited_work":{"arxiv_id":"2203.13474","doi":"10.48550/arxiv.2203.13474","metadata_source":"pith","pith_arxiv_id":"2203.13474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CodeGen: An Open Large Language Model for Code with Multi-Turn Program Synthesis","venue":"cs.LG","work_id":"892a192d-205a-4079-a807-00d7874b392e","year":2022},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2203.13474","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:d1bb3d9f0b2cde2a2dc1e055c9e5fb564ea3b161c034ddcdcd4281642b125817","observation_id":"5060f31d-77da-454f-b6ac-6fb5b8031f2e","resolution":{"observed_at":"2026-05-20T10:58:14.604489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Competition-level code generation with alphacode.Science, 378(6624):1092–1097","venue":null,"work_id":"bec1f55b-a9cb-4aa6-bcad-cc59083b9ba6","year":2022},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:a935ab519c78cd1702517e4d79225e71e0e868d87ecfc14fdf944e740dfe8a22","observation_id":"42fa2780-eb86-442b-8838-d65ee6051acd","resolution":{"observed_at":"2026-05-20T14:03:30.854831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":"2310.06770","doi":"10.1145/512927.512945","metadata_source":"pith","pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":"cs.CL","work_id":"d0effe15-a689-441a-8e3f-ea35f1c4e4b1","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:fda0897e2d18bc0133af751707c753525956c5ca1cfde8f9c99db904cc9c0276","observation_id":"6d8fdd2d-0aeb-46a4-ad73-acbb56f8f9f3","resolution":{"observed_at":"2026-05-20T10:58:14.589779Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":"2211.12588","doi":"10.48550/arxiv.2211.12588","metadata_source":"pith","pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","venue":"cs.CL","work_id":"618aa44c-a6c6-425c-abce-8aa8aa842921","year":2022},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:4bc9739eb1fd08ea9371d5008d5b24de1a0424d13a0dc8f17135258defaef8e5","observation_id":"644ebf91-4758-422c-ba8b-0cf9b600fe1c","resolution":{"observed_at":"2026-05-20T10:58:14.601587Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pal: Program-aided language models","venue":null,"work_id":"6e52036a-b072-4f38-a482-cf0a94d533a4","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:2d88e142357c08b5d12429e5e7b478fa65bdc15639989b1c9b0b272f933ee6d6","observation_id":"b6c776ed-2d70-41b6-a351-0de009a72d1d","resolution":{"observed_at":"2026-05-20T14:03:30.852744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04474","last_updated":"2024-07-29T20:21:37Z","snapshot_observed_at":"2026-08-04T22:59:33.934680Z","submitted_at":"2023-12-07T17:51:43Z","title":"Chain of Code: Reasoning with a Language Model-Augmented Code Emulator","version":4},"cited_work":{"arxiv_id":"2312.04474","doi":"10.48550/arxiv.2312.04474","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.04474","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of code: Reasoning with a language model-augmented code emulator","venue":"arXiv (Cornell University)","work_id":"9c08075c-c0f0-4fe9-9afa-2972fdf6868b","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2312.04474","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:ef66c96c451795ebe93aeb26d14fdee6d2dba498076d97b253512c61cd62a98b","observation_id":"8ae524aa-c665-4ebb-a85a-7843d92a1443","resolution":{"observed_at":"2026-05-20T10:58:14.596011Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":"2204.01691","doi":"10.48550/arxiv.2204.01691","metadata_source":"pith","pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","venue":"cs.RO","work_id":"037320f1-b0a9-4cbe-a639-bfb25409ce71","year":2022},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:cbe87a6f4b31600059f0933e2f4bb083c833f98a06eba38727d73e2d1d8aaf87","observation_id":"79eaebcd-3a1f-471c-abe6-152f95aa8cbf","resolution":{"observed_at":"2026-05-20T10:58:14.607478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:37:07.167771Z","title":"Code as policies: Language model programs for embodied control","venue":null,"work_id":"398c4226-f3ef-4286-9a41-e873b848a72e","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:431025ce77f7ec3b367ac6407a2679bc419a484183114f5068d4d8342ed35b69","observation_id":"d5855829-27e1-4879-af1e-e031212a392b","resolution":{"observed_at":"2026-05-20T14:03:30.774031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intercode: Standardizing and benchmarking interactive coding with execution feedback.Advances in Neural Information Processing Systems, 36:23826–23854","venue":null,"work_id":"42613f44-4012-404b-8c48-b9737492db5e","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:dfdf82c3db92f6db9f45d8f447424ab0825d9a2049d2fa026c6dc577fe268b00","observation_id":"2ed9be55-4d78-4387-a56f-21c85bf87831","resolution":{"observed_at":"2026-05-20T14:03:30.779491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-04T04:48:34.061129Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":"2308.03688","doi":"10.1109/fllm63129.2024.10852426","metadata_source":"pith","pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgentBench: Evaluating LLMs as Agents","venue":"cs.AI","work_id":"a37549b4-4c94-412d-acc4-4efeb08509be","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:6737e5b4883d60fb5a928842f74ee86a5e8444f249ecbc6cd74af4ae2824f4ed","observation_id":"19d9027c-8f82-4dfa-b0a4-f9753513349d","resolution":{"observed_at":"2026-05-20T10:58:14.168982Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.28052","last_updated":"2026-03-30T05:33:50Z","snapshot_observed_at":"2026-07-06T22:51:00.579062Z","submitted_at":"2026-03-30T05:33:50Z","title":"Meta-Harness: End-to-End Optimization of Model Harnesses","version":1},"cited_work":{"arxiv_id":"2603.28052","doi":"10.48550/arxiv.2603.28052","metadata_source":"pith","pith_arxiv_id":"2603.28052","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Meta-Harness: End-to-End Optimization of Model Harnesses","venue":"cs.AI","work_id":"5be3c079-4ffa-458f-adcf-204b66f7af51","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2603.28052","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:01aea1d228b23993f2a67c59c150ba3e73ffe88d1b60352773aef1de557a9a2b","observation_id":"de0be889-0400-4a27-b736-c98c7af1ec5c","resolution":{"observed_at":"2026-05-20T10:58:14.141405Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Effective harnesses for long-running agents","venue":null,"work_id":"06ca0aef-5255-4c7f-9f92-26ee381777cf","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:105882f8f11b50e1157719b0a4009e97d3009630a097963e311d446364523c08","observation_id":"62091a2a-0c50-4260-b9b1-6ff35083e5f4","resolution":{"observed_at":"2026-05-20T14:03:30.804948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Harness engineering: Leveraging codex in an agent-first world.https://openai","venue":null,"work_id":"e67d1795-21d6-464b-87cb-aae0f38bd62c","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:7a19f3a8811fd8779bb51d07457dc83b383653ef105ace3e7a357c3fe82f0a41","observation_id":"13a4d9e4-1f5e-4d85-9ed4-bccd3c7270c9","resolution":{"observed_at":"2026-05-20T14:03:30.546868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.04618","last_updated":"2026-03-29T09:18:02Z","snapshot_observed_at":"2026-07-06T22:31:49.574184Z","submitted_at":"2025-10-06T09:30:18Z","title":"Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models","version":3},"cited_work":{"arxiv_id":"2510.04618","doi":"10.48550/arxiv.2510.04618","metadata_source":"pith","pith_arxiv_id":"2510.04618","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentic Context Engineering: Evolving Contexts for Self-Improving Language Models","venue":"cs.LG","work_id":"c1d09cf9-9176-403d-8028-630bbc0cbc5d","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2510.04618","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:485fc358191a2e6f8dc15288056521923028bdd534d86e3edae958340d8c2466","observation_id":"c9c18424-cedc-4d73-a54a-5d01a763ca36","resolution":{"observed_at":"2026-05-20T10:58:14.557342Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:03.57435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:03.57435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.19457","last_updated":"2026-02-14T11:42:30Z","snapshot_observed_at":"2026-07-06T22:02:56.216824Z","submitted_at":"2025-07-25T17:42:32Z","title":"GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2507.19457","doi":"10.48550/arxiv.2507.19457","metadata_source":"pith","pith_arxiv_id":"2507.19457","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning","venue":"cs.CL","work_id":"40b60d06-dc1c-4799-b75d-ff1eca653049","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2507.19457","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:c25b35fa1c0ddb6a3e64add2246a4ffbab8cdc6659968a252078ced52c5961df","observation_id":"ff6d6d18-74b5-476f-bb63-1c6fc777c865","resolution":{"observed_at":"2026-05-20T10:58:14.568744Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:19.13226+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:19.13226+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04032","last_updated":"2023-09-11T06:33:46Z","snapshot_observed_at":"2026-07-06T15:24:07.662207Z","submitted_at":"2023-05-06T12:45:28Z","title":"ToolCoder: Teach Code Generation Models to use API search tools","version":5},"cited_work":{"arxiv_id":"2305.04032","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.04032","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Toolcoder: Teach code generation models to use api search tools","venue":null,"work_id":"89557adf-dd62-4af8-b031-c76ce566e5fc","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2305.04032","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:88f82439b464aa815ac0a10e6bb3638122f2ae259ea6aba12f8aaa42a4464b84","observation_id":"d1490ede-d7c8-4a16-b2d5-b929bbfdd4e1","resolution":{"observed_at":"2026-05-20T10:58:14.532884Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Teaching code llms to use autocompletion tools in repository-level code generation.ACM Transactions on Software Engineering and Methodology, 34(7):1–27","venue":null,"work_id":"98483949-d132-451e-9879-c5516d9db550","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:76d5aa595dd945e857f0ef8fdfb0e1184425ecf49435b38fb00ea0971aca0eb4","observation_id":"6380dea5-89f4-406d-aabf-21643f193f89","resolution":{"observed_at":"2026-05-20T14:03:30.683066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.10948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T11:05:42.266085Z","title":"Execution guided line-by-line code generation","venue":null,"work_id":"9fd2833a-2d86-4727-9bd6-aabad25f6a92","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:12b910a7d454b28daddd1dd4caa29a45d7d0d6ed8c1e4e5192069b83e237f46c","observation_id":"433d2d70-ab53-4ec8-a24e-daa34df42ad8","resolution":{"observed_at":"2026-05-20T10:58:14.535672Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.16206","last_updated":"2026-04-08T06:37:40Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T18:57:09Z","title":"Computer Environments Elicit General Agentic Intelligence in LLMs","version":3},"cited_work":{"arxiv_id":"2601.16206","doi":"10.48550/arxiv.2601.16206","metadata_source":"pith","pith_arxiv_id":"2601.16206","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Computer Environments Elicit General Agentic Intelligence in LLMs","venue":"cs.CL","work_id":"02703346-e8ea-4c37-a276-be70203d9fe5","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2601.16206","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:3b9f17b275e8c8372f956d48973ce124171236bcde3f6911e5edb699d3e8d7d4","observation_id":"f789340d-971e-4f5e-b7f7-adfcbeaa294c","resolution":{"observed_at":"2026-05-20T10:58:14.504211Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.06939","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T19:28:51.854444Z","title":"Feedbackeval: A benchmark for evaluating large language models in feedback-driven code repair tasks","venue":null,"work_id":"b2a2c35c-92b4-499c-a008-e65890c2eaee","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:7cc68b3c6a6c09ee9b8c9f55e52b65a5d67c8da10743f4efa17b5c578e9f1139","observation_id":"111c2bbb-117e-4e6b-b032-9002a60c9802","resolution":{"observed_at":"2026-05-20T10:58:14.467724Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Harness engineering: Leveraging codex in an agent-first world","venue":null,"work_id":"5349ca12-d2f9-4e3d-839d-d569e95c3bc2","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:70e100b4ccb77cb99051f0642836925df0e6fe465626d8cbf33c1760b557f898","observation_id":"f6ebfaee-be97-49e2-88a5-c0d06ec15d78","resolution":{"observed_at":"2026-05-20T14:03:30.835905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The anatomy of an agent harness","venue":null,"work_id":"332f4f58-1482-4fc1-9d6f-b75c5a694314","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:2024d766d18c412e3ab4d746d4fd9dcea158e5cd861b81279f2e3361c73d7bb2","observation_id":"7de584e4-adce-4a0a-8038-64b5e55cb12d","resolution":{"observed_at":"2026-05-20T14:03:30.833931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Claude code","venue":null,"work_id":"d2b7bbf2-3d8b-4a3b-aa95-f22a8d66c20e","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:40354f354925b35cc546a3d156ab755f9c969527aa4436365e553fc0a41f84e3","observation_id":"bfc2c5cc-e85c-4ab8-a495-fbb0f2a2986b","resolution":{"observed_at":"2026-05-20T14:03:30.617795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Introducing Codex","venue":null,"work_id":"93a253f3-dc13-4715-b021-73326afe0ca8","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:e92d4cc8ffe06b5dc9f587489c88762f93a349e850598b5cdc23fb279350cd23","observation_id":"de352bb3-0f6c-46d4-bde1-53f79027e064","resolution":{"observed_at":"2026-05-20T14:03:30.772546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving deep agents with harness engineering","venue":null,"work_id":"7f35600b-11fe-4b71-8112-30c2afe99c54","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:b383df5cd4166ecb2ce844d1c5e2745900ff00de366eaffd174993190026c013","observation_id":"0fe19308-cc69-4760-88de-aa1e28baaf8d","resolution":{"observed_at":"2026-05-20T14:03:30.725144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Satlm: Satisfiability-aided language models using declarative prompting.Advances in Neural Information Processing Systems, 36:45548–45580","venue":null,"work_id":"fce28154-2c1d-4e7d-92c0-aa8de37f24a2","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:cd08baa467c4d0d69dc9257070c48f719d26ad1100369dd4664b59faf7f9e304","observation_id":"926abe06-0691-4574-8912-937516e02f74","resolution":{"observed_at":"2026-05-20T14:03:30.837932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14662","last_updated":"2024-04-23T01:46:32Z","snapshot_observed_at":"2026-07-06T18:04:04.541434Z","submitted_at":"2024-04-23T01:46:32Z","title":"NExT: Teaching Large Language Models to Reason about Code Execution","version":1},"cited_work":{"arxiv_id":"2404.14662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.14662","snapshot_observed_at":"2026-06-30T13:44:41.795923Z","title":"Next: Teaching large language models to reason about code execution","venue":null,"work_id":"80c4a111-b0e1-4d17-a8e8-8c0bb65f28a9","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2404.14662","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:a0a1614fe14b871f2aff62a45e5e362b2009d7ed1ed753f96a9b0f25adc84ab6","observation_id":"38b6bc2c-4ef0-4cb9-b488-01ba34986627","resolution":{"observed_at":"2026-05-20T10:58:14.517676Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Codeprm: Execution feedback-enhanced process reward model for code generation","venue":null,"work_id":"77ea55a7-95ca-4650-8193-a99683c098e9","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:34a55a77ed359e5b0f63a2323e5599b6323d80fb53b4e50479e931f6248b6219","observation_id":"ce33b0b7-ed78-4dcc-99c5-e8156bd81e77","resolution":{"observed_at":"2026-05-20T14:03:30.774746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16291","last_updated":"2023-10-19T16:27:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-25T17:46:38Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","version":2},"cited_work":{"arxiv_id":"2305.16291","doi":"10.18653/v1/2023.emnlp-main.118","metadata_source":"pith","pith_arxiv_id":"2305.16291","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Voyager: An Open-Ended Embodied Agent with Large Language Models","venue":"cs.AI","work_id":"ffe0d207-86cf-4742-a100-e988ac8b9676","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2305.16291","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:d1386a0f6ff766154a4ecb47c3738dee209a1bb2ffcf3f7550efb864ab7ff15a","observation_id":"81ae367b-5fc6-45b9-80c4-e17b5b1519fe","resolution":{"observed_at":"2026-05-20T10:58:14.484966Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16117","last_updated":"2024-02-25T15:31:43Z","snapshot_observed_at":"2026-07-06T17:35:10.248760Z","submitted_at":"2024-02-25T15:31:43Z","title":"RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis","version":1},"cited_work":{"arxiv_id":"2402.16117","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.16117","snapshot_observed_at":"2026-07-10T07:26:54.446341Z","title":"Robocodex: Multimodal code generation for robotic behavior synthesis","venue":"cs.RO","work_id":"afd30983-1b13-4fb6-ac5c-5fc090451a23","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2402.16117","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:3b43534e85f33b3242dc4c9633bb55d0f67f6a0fd5fa054a247db051c4ddb944","observation_id":"5d2b6f99-f226-4101-a6df-ba9ea8725705","resolution":{"observed_at":"2026-05-20T10:58:14.309078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Code- bt: A code-driven approach to behavior tree generation for robot tasks planning with large language models","venue":null,"work_id":"126beb55-2818-4c12-91b4-4d3f1c9d3205","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:5cea3b94e55cfb4beb24f3c504b37beccfcd24592545ebdbab53a014025eecad","observation_id":"264137a1-e1d6-4999-9369-4f448be66327","resolution":{"observed_at":"2026-05-20T14:03:30.711965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.24533","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T00:29:16.192660Z","title":"Ui-voyager: A self-evolving gui agent learning via failed experience","venue":null,"work_id":"185cb3bf-582e-4dd8-aad7-15652cb1ed62","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:0197f96ffb357337fd55b6ca2159db8223fdcca5e1e36e7b5f3557da7b957df8","observation_id":"9f36f6e1-50f8-4e76-a570-6e8b0047b9b6","resolution":{"observed_at":"2026-05-20T10:58:14.268100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T02:45:54.582105Z","title":null,"venue":null,"work_id":"b38d99c8-3f0b-49a8-833d-731376a7d4b3","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:07aba718001db6127c4e2492727108f6291234a91ad10cdddc94b9d12eb9ad9f","observation_id":"8c30c19e-8e51-4b52-b21a-32c5bc9bdfe1","resolution":{"observed_at":"2026-05-20T14:03:30.839834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.02387","doi":"10.48550/arxiv.2510.02387","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cwm: An open-weights llm for research on code generation with world models","venue":"ArXiv.org","work_id":"7a74903a-6383-48ce-97b8-17afa5faeae1","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:e166d98413ce050916fe4218efeb04b289411d3da7c2777a36c463433a872789","observation_id":"5ddd27f3-d1e2-4a48-83e5-77db0b6cca91","resolution":{"observed_at":"2026-05-20T10:58:14.401245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.09856","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:09:59.313952Z","title":"Code2world: A gui world model via renderable code generation","venue":null,"work_id":"9ee28d94-edc8-4660-81eb-40b5d9e02315","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:89e549378d0fe3ac018bdb675b2352d5c15ca2f36f10cd7962f46d74d7cea941","observation_id":"3c35c3cf-3a60-40ac-80f8-c296d34d6da3","resolution":{"observed_at":"2026-05-20T10:58:14.383201Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.16443","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:09:59.253426Z","title":"Endless terminals: Scaling rl environments for terminal agents","venue":null,"work_id":"4011aefe-a13d-4d88-af17-a89fb6a83b2b","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:6bf0bb0491814f19908d16a0d506b85d67d3e7c9656c15a89f55625b299dbee0","observation_id":"a8d1e63b-dd6f-4428-b01e-57f2b4e3d689","resolution":{"observed_at":"2026-05-20T10:58:14.432249Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-planning code generation with large language models.ACM Transactions on Software Engineering and Methodology, 33(7):1–30","venue":null,"work_id":"c5e9fed8-c6b4-4d50-b429-db075348a9d4","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:ce9c8930c2bfb25e45118b659a7ccc196c31c8f1a84526170b061642e106af37","observation_id":"7eefce52-8556-43d1-9a05-66ba87570b4d","resolution":{"observed_at":"2026-05-20T14:03:30.760555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12856","last_updated":"2024-02-25T16:17:43Z","snapshot_observed_at":"2026-07-06T15:57:53.178833Z","submitted_at":"2023-07-24T14:56:30Z","title":"A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis","version":4},"cited_work":{"arxiv_id":"2307.12856","doi":"10.48550/arxiv.2307.12856","metadata_source":"pith","pith_arxiv_id":"2307.12856","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Real-World WebAgent with Planning, Long Context Understanding, and Program Synthesis","venue":"cs.LG","work_id":"0915d1fc-bc46-4128-871e-f9233dca44b6","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2307.12856","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:e001195936a738e6e8591e884674104b99edc1c9f6d0bee16efa820e2b6d79ea","observation_id":"c31d85a3-8433-4499-a2cb-97c46bd51cfa","resolution":{"observed_at":"2026-05-20T10:58:14.340512Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Codeplan: Repository-level coding using llms and planning.Proceedings of the ACM on Software Engineering, 1(FSE):675–698","venue":null,"work_id":"db5ab961-3197-4011-b7e3-ddbc3cb53b3b","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:23d23d190191dd3a5a4a9e49749c4f41560760e62f4485417f660a8f8d6d6fe8","observation_id":"58836e30-c8ec-4425-bfc1-6ee217d538f1","resolution":{"observed_at":"2026-05-20T14:03:30.756444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Codetree: Agent-guided tree search for code generation with large language models","venue":null,"work_id":"5cddfb4a-2739-4eb3-acf3-a65c222e491b","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:579271f4a132052258281a19da97ea44ba31362eb45e42be01d4d127e01f279c","observation_id":"b15fbd8f-9c68-4186-990c-7f8fe48172ed","resolution":{"observed_at":"2026-05-20T14:03:30.772168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mapcoder: Multi-agent code generationforcompetitiveproblemsolving","venue":null,"work_id":"fe7d492d-18c8-4313-b310-8b17f4dc88ce","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:90fd9fd7b0d56e4bbc07199f1d2e54be27d85d709e87f08cbed156dbec4ee806","observation_id":"faa4ea4e-01a5-4696-96e9-76855bfa7d62","resolution":{"observed_at":"2026-05-20T14:03:30.842030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.15813","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Codemem: Architectingreproducible agents via dynamic mcp and procedural memory","venue":null,"work_id":"e58edf98-3f4d-42b8-918a-1741916bab72","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:8133384a61edd068fcf641d187ea82659c6bb38ac795ca0cd895218bb4459817","observation_id":"b6974d82-4233-425e-a53e-4ff749156ee1","resolution":{"observed_at":"2026-05-20T10:58:14.336840Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autocoderover: Autonomous program improvement","venue":null,"work_id":"8e31f20e-dfcd-41eb-a4f7-1823ea11fdb5","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:a76699400b380305cc639e593557187a93d28dc3d5ec029fb8118f840323cade","observation_id":"be6dcead-5c69-4d72-9a19-efa867ab3e8c","resolution":{"observed_at":"2026-05-20T14:03:30.754362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Repocoder: Repository-level code completion through iterative retrieval and generation","venue":null,"work_id":"d61c7744-6c61-45aa-b5c8-9c034a3970f8","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:23a8f0d6f368d13eb3254c9a03d5786eeb5c49aba18b2f37f5e9f1eefcc31cc9","observation_id":"b6e7a73b-0d27-4dea-bfd0-7e9bec458a07","resolution":{"observed_at":"2026-05-20T14:03:30.459883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.06789","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:18:22.573508Z","title":"Memgovern: Enhancing code agents through learning from governed human experiences","venue":null,"work_id":"0c72f8d3-d705-43e1-9d68-1f67a0d4a93d","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:f995aece0757327bdf1b3663e7f98fe903fe11214a5e98a95016f6820cc00e1f","observation_id":"3e94e8e3-180e-43f8-aaad-c607b9ac5171","resolution":{"observed_at":"2026-05-20T10:58:14.283872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00839","last_updated":"2024-02-29T02:04:00Z","snapshot_observed_at":"2026-07-06T17:38:17.853302Z","submitted_at":"2024-02-29T02:04:00Z","title":"ToolNet: Connecting Large Language Models with Massive Tools via Tool Graph","version":1},"cited_work":{"arxiv_id":"2403.00839","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.00839","snapshot_observed_at":"2026-07-03T13:28:19.032648Z","title":"Toolnet: Connecting large language models with massive tools via tool graph","venue":null,"work_id":"6472076e-87bf-41de-92b3-6340f9e231b6","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2403.00839","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:b47da3f5503402c777ef38ece5d7f91bb4d06059ade4a5cd595c56c03a6ea3d9","observation_id":"23612896-7f42-42fc-a090-c83edecbdecc","resolution":{"observed_at":"2026-05-20T10:58:14.246963Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13010","last_updated":"2024-05-24T11:47:24Z","snapshot_observed_at":"2026-07-06T17:05:56.282078Z","submitted_at":"2023-12-20T13:22:41Z","title":"AgentCoder: Multi-Agent-based Code Generation with Iterative Testing and Optimisation","version":3},"cited_work":{"arxiv_id":"2312.13010","doi":"10.48550/arxiv.2312.13010","metadata_source":"pith","pith_arxiv_id":"2312.13010","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgentCoder: Multi-Agent-based Code Generation with Iterative Testing and Optimisation","venue":"cs.CL","work_id":"a59b2f13-e7d4-4d8b-bffd-504f2417da02","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2312.13010","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:099245e379623689e28e5603054ab9656f5fbc27277c3ccdcdb0218b47cf9ede","observation_id":"9a643d2c-0598-4c53-b323-305f3f028d0b","resolution":{"observed_at":"2026-05-20T10:58:14.297813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adacoder: Adaptive prompt compression for programmatic visual question answering","venue":null,"work_id":"ea5b4da1-359a-4874-92ff-dc7f2ff9d3d3","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:f1ca665d368574e30730300053ff016873fa5e6936c32bfc87fd181ea9705e4c","observation_id":"d8362e79-4ad3-4e5c-96ab-f51ad51b9803","resolution":{"observed_at":"2026-05-20T14:03:30.844124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10737","last_updated":"2024-11-05T03:00:38Z","snapshot_observed_at":"2026-07-06T19:16:23.103921Z","submitted_at":"2024-09-16T21:15:56Z","title":"AutoSafeCoder: A Multi-Agent Framework for Securing LLM Code Generation through Static Analysis and Fuzz Testing","version":2},"cited_work":{"arxiv_id":"2409.10737","doi":"10.48550/arxiv.2409.10737","metadata_source":"arxiv_reference","pith_arxiv_id":"2409.10737","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AutoSafeCoder: Amulti-agentframeworkforsecuring LLM code generation through static analysis and fuzz testing","venue":"arXiv (Cornell University)","work_id":"ac9463c3-dc05-4cb9-b543-09c43c2d95fa","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2409.10737","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:cfbe15af8e4fae785069857e334a56d306e904370ba8258f89436ed5cf66e8b8","observation_id":"de3b250f-7984-4e84-8ffa-ac4f667740a0","resolution":{"observed_at":"2026-05-20T10:58:14.583424Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Agent harness engineering: A survey","venue":null,"work_id":"2d27d06d-d063-43a6-a612-bc7b84e06789","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:2df22c7e34d3e5a51d3cae3f3d627414acf26e273da72adca37fe88aad2b1a30","observation_id":"7306c55a-f1ad-4496-8089-077eff3ec87c","resolution":{"observed_at":"2026-05-20T14:03:30.778085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T13:33:50.923956Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversations","venue":null,"work_id":"e57ce12a-7d16-4d21-a253-28bdb8094e1a","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:bb74904e48ec03dca341cb04ca715a405371b137bfb00ec0e95debe832977798","observation_id":"1a966c2e-2971-42af-84c2-0dd189aee23a","resolution":{"observed_at":"2026-05-20T14:03:30.539542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metagpt: MetaprogrammingforAmulti-agentcollaborativeframework","venue":null,"work_id":"5d3b7bbe-a873-4a01-8188-175b016ab713","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:7d12e944e82717279cbff5777e36a0bf0db3050317e6e5ca996ddb2bba6db170","observation_id":"bd118331-d3df-4b49-be96-88d064011fb4","resolution":{"observed_at":"2026-05-20T14:03:30.672633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ba39fa3a-029d-44b0-81f7-1b2b5ed52a78","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:acdd735111b076ed03829c76cf15986ba5e42a0123e4f773be968707449a1a19","observation_id":"72dd6ad3-8f77-43c1-9d84-b4b50f8eccf1","resolution":{"observed_at":"2026-05-20T14:03:30.717206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:24:54.955583Z","title":"Swe-agent: Agent-computer interfaces enable automated software engineering.Advances in Neural Information Processing Systems, 37:50528–50652","venue":null,"work_id":"0621aa9d-3c5d-4171-ba59-3d6fb78d570d","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:b740f7975161c37e99ff3139f51dba889fba548205e69b25c87b43cabe3e9edd","observation_id":"6428f340-d73f-4f01-9faf-880ab543fc92","resolution":{"observed_at":"2026-05-20T14:03:30.745606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Xu, Xiangru Tang, Mingchen Zhuge, Jiayi Pan, Yueqi Song, Bowen Li, Jaskirat Singh, Hoang H","venue":null,"work_id":"aa115fe5-14fe-4a24-98b9-b72130322294","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:73957242e2b8ddf35a3e2062004f6ac13abf78846e07cbf0471d2774cffcaff7","observation_id":"1c5b452a-5ff9-4a68-a850-5ca17c52a838","resolution":{"observed_at":"2026-05-20T14:03:30.534017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mind2web: Towards a generalist agent for the web","venue":null,"work_id":"ff3fe3c0-8b2e-4c10-a302-07e04035753e","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:2e698cbd7c3db4c276ea138a7881027837f2f5b53d6735e90ea6809d68bc2211","observation_id":"11839a3d-f82a-4f0a-97ca-e5ba6292e97d","resolution":{"observed_at":"2026-05-20T14:03:30.738215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-07-06T15:58:31.756298Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":"2307.13854","doi":"10.48550/arxiv.2307.13854","metadata_source":"pith","pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","venue":"cs.AI","work_id":"7058ffd2-a339-4102-89eb-248eeb074652","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:dfd764e61a8f8685d0410a594a02c25e6286fcd763fa98426a10b0ac0f57504d","observation_id":"25ae2070-6995-4fda-a660-cfdaea95fe83","resolution":{"observed_at":"2026-05-20T10:58:14.225716Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05376","last_updated":"2023-10-02T17:03:01Z","snapshot_observed_at":"2026-07-06T15:14:32.823996Z","submitted_at":"2023-04-11T17:41:13Z","title":"ChemCrow: Augmenting large-language models with chemistry tools","version":5},"cited_work":{"arxiv_id":"2304.05376","doi":"10.48550/arxiv.2304.05376","metadata_source":"pith","pith_arxiv_id":"2304.05376","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ChemCrow: Augmenting large-language models with chemistry tools","venue":"physics.chem-ph","work_id":"1ceaeb05-7517-4fbd-ba9a-7a63c96b23e6","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2304.05376","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:e64e71d38299e9895c7261153cd8f151cada99c50ecbda4c6d38c5dedfc8eb11","observation_id":"23b85001-224e-4b7c-b352-ac0aedad8a95","resolution":{"observed_at":"2026-05-20T10:58:14.235874Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autonomous chemical research with large language models.Nature, 624(7992):570–578","venue":null,"work_id":"0d4b6995-ed99-417a-9843-8d70489bf0b4","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:906bd90be981813d6d37067d0e91d3c93aca867bbe1a1812b2be68a41c097d2f","observation_id":"d6cdb523-abdc-4b6f-b936-e751c82bb229","resolution":{"observed_at":"2026-05-20T14:03:30.850487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":"2408.06292","doi":"10.48550/arxiv.2408.06292","metadata_source":"pith","pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","venue":"cs.AI","work_id":"56b6b58d-e73a-4317-896e-36ac5f84e957","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:0514b150cacb91b82fd9a3622da89076afca6c02888c29107ee93d11f115a66e","observation_id":"77dc1f0d-ee4d-4783-989b-ef342d2af1e5","resolution":{"observed_at":"2026-05-20T10:58:14.177934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:20.611352+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:20.611352+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T02:30:41.233037Z","title":"Biomni: A general-purpose biomedical ai agent.biorxiv","venue":null,"work_id":"c28414d4-ff79-491c-8858-6be83ec70812","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:9de95062972f601ba1cb43f97b8f2a0be63ca09c6c76c69bba761c5a3ca62b95","observation_id":"77c8cc45-e424-4a14-89ec-f556f807c7e0","resolution":{"observed_at":"2026-05-20T14:03:30.787533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:37:03.941805Z","title":"Chain-of-thought prompting elicits reasoning in large language models.Advances in neural information processing systems, 35:24824–24837","venue":null,"work_id":"3256b5a6-76d9-460c-ad77-5d232058ad6d","year":2022},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:06c41bd37c3f61103f2790716a03204cdef5e6b8d2413a84753585e90a2bee06","observation_id":"106f8ee7-0fd4-4713-898c-469fcd87a30d","resolution":{"observed_at":"2026-05-20T14:03:30.576827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Show your work: Scratchpads for intermediate computation with language models","venue":null,"work_id":"f7ff1222-3014-46cf-bd7d-ee58093991d8","year":2021},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:a21849518c5430d217498900cbd6faa6e5e9adb5350d6e7aa691f77ba02be404","observation_id":"65c3a7a4-259f-47b3-a2d7-6ffec4d1780b","resolution":{"observed_at":"2026-05-20T14:03:30.627123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasoning like program executors","venue":null,"work_id":"a604f2a5-9ed9-42c6-b6a6-b3bd9cc0975a","year":2022},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:f3137cba6ba117f116db70793264e9a67a14dd439fc7cc417cb5b8604dabc5d4","observation_id":"4118a341-7994-4f22-b270-6790a31e65e1","resolution":{"observed_at":"2026-05-20T14:03:30.761414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03731","last_updated":"2023-10-05T17:52:09Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:52:09Z","title":"MathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":"2310.03731","doi":"10.48550/arxiv.2310.03731","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.03731","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mathcoder: Seamless code integration in llms for enhanced mathematical reasoning","venue":"arXiv (Cornell University)","work_id":"36308722-f027-40ce-b4e0-8d2c26bb0f9e","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2310.03731","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:2ce058e32c7f185a3a6b9476c87b2acbb5d23bbadcf9be82fc1e8ce69e98779e","observation_id":"3df5e4aa-3530-413b-a8fc-a265b487c964","resolution":{"observed_at":"2026-05-20T10:58:14.192945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"When do program-of-thought works for reasoning? InProceedings of the AAAI conference on artificial intelligence, volume 38, pages 17691–17699","venue":null,"work_id":"55ebdf8c-1208-4a09-97ad-b05cc8c9c6f8","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:3c5cdcd7b508b2c82a8fd3cae869dc8a51c58dcbd5b4bf3fd0683a83500ea8ca","observation_id":"a3355e07-2485-4035-b694-5d41d3b68a69","resolution":{"observed_at":"2026-05-20T14:03:30.732811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards better understanding of program-of-thought reasoning in cross-lingual and multilingual environments","venue":null,"work_id":"13e84b4d-19c6-49e1-9d20-3561d5c1bcce","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:49a35e8f96fbd641953fdff8313739af939ec57809815459c00fde4a3a49596b","observation_id":"a6c7dd43-08b0-49cb-ad33-a92aa2314631","resolution":{"observed_at":"2026-05-20T14:03:30.780479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04289","last_updated":"2025-08-07T04:14:31Z","snapshot_observed_at":"2026-08-03T11:46:07.174136Z","submitted_at":"2025-08-06T10:26:52Z","title":"Method-Based Reasoning for Large Language Models: Extraction, Reuse, and Continuous Improvement","version":2},"cited_work":{"arxiv_id":"2508.04289","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04289","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Method-based reasoning for large language models: Extraction, reuse, and continuous improvement","venue":null,"work_id":"c228aa40-3c66-414c-ba2b-d93c2e4c2d8a","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2508.04289","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:336d6c20a865edd2723fcf7d8c13d0369dd33deef9f962e1d4ad1b11f3e41214","observation_id":"e3e4049b-ae13-4ced-9f0b-64bd7b3ba692","resolution":{"observed_at":"2026-05-20T10:58:14.151385Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.20909","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Code- enabled language models can outperform reasoning models on diverse tasks","venue":null,"work_id":"34e7517b-171d-453e-a05f-cf57ab82528c","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:d6aa2fa5527ba7cc4e13e49adf5bf5fa95bc7644039327f03374bea1480a0719","observation_id":"127817bf-c411-458e-a610-e9029a0006fc","resolution":{"observed_at":"2026-05-20T10:58:14.162603Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CodeIO: Condensing reasoning patterns via code input-output prediction","venue":null,"work_id":"79af1eb0-2e89-4efe-8335-01b419f8a6d5","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:d6c755bb7b83c0bea36667b7c7ca584ddb2115522d6c1968da0e0ddb45306ff3","observation_id":"00f0539d-1d94-43ab-8dd0-34c66f5a5623","resolution":{"observed_at":"2026-05-20T14:03:30.585674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Graph of thoughts: Solving elaborate problems with large language models","venue":null,"work_id":"6c5125ef-d5d0-4032-a6bd-99d1d898edc1","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:78c2144e348457f194e06748fb643141670d65c0c2f2202d33b97bca35451676","observation_id":"8c92a7b2-1c28-4dcc-9243-fdf522efb01c","resolution":{"observed_at":"2026-05-20T14:03:30.655555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.12157","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-verifying reflection helps transformers with cot reasoning","venue":null,"work_id":"e4f834a2-1b90-497e-8275-85ddfc02657c","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:eb3e37c18e8069037ad20e74c735b624cc36af9ad05d6aff6859069f29f28664","observation_id":"de50c086-ed5c-4da7-9703-00019c8bd6ae","resolution":{"observed_at":"2026-05-20T10:58:14.138371Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ma-lot: Multi-agent lean-based long chain-of-thought reasoning enhances formal theorem proving.arXiv e-prints, pages arXiv–2503","venue":null,"work_id":"64b74e08-4bbf-46d1-bf1e-a7675fffd9e5","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:e28fea9681a794756458a7ed5f2aad7c81ae04a472819da7f074ee064cbd2f2b","observation_id":"605452b3-8114-4471-8d60-85cc9a0d4414","resolution":{"observed_at":"2026-05-20T14:03:30.624681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.10621","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ssr: Socratic self-refine for large language model reasoning","venue":null,"work_id":"ee9719b4-4291-4b73-954b-5c142021d2e9","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:c8f6e4ef4cb83d817906ad448becb338aced68296dd299107a7bad9b5d9bf96f","observation_id":"524ce744-1497-4cc8-a535-35b5661e39e1","resolution":{"observed_at":"2026-05-20T10:58:14.181301Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04350","last_updated":"2025-05-29T00:38:10Z","snapshot_observed_at":"2026-07-06T20:32:23.502480Z","submitted_at":"2025-02-04T15:53:59Z","title":"CodeSteer: Symbolic-Augmented Language Models via Code/Text Guidance","version":2},"cited_work":{"arxiv_id":"2502.04350","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.04350","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Codesteer: Symbolic- augmented language models via code/text guidance","venue":null,"work_id":"5278d4a6-b815-44c0-905f-958cc985fc46","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2502.04350","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:398b6d0ef0d2521cd012e1eaefb62a2bcca6123ea29fc6022db4188e49cef057","observation_id":"5f9916de-7c19-4ba1-8705-1b7a8f6b801e","resolution":{"observed_at":"2026-05-20T10:58:14.273239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Code-as-symbolic-planner: Foundation model-based robot planning via symbolic code generation","venue":null,"work_id":"a2c50972-9b6a-4449-902a-3f58abef2ae8","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:bc81544563b83170b7574e295a2f219278b51e29efe7507de0bf175192819cd5","observation_id":"0fc96cfe-c9b4-42f9-b4e9-4dda03bd4965","resolution":{"observed_at":"2026-05-20T14:03:30.752436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:17:03.600265Z","title":"In: Zong, C., Xia, F., Li, W., Navigli, R","venue":null,"work_id":"8d675bdd-79ca-48d6-9163-fc17ce0e8ece","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:c641c972088d504a57c53d6cb7b6b58fcf7257f4b6cfbf13ceba24e832b0df34","observation_id":"a5ad446b-b3e5-4f2e-a25b-8856bcb59c0c","resolution":{"observed_at":"2026-05-20T10:58:13.305883Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T09:34:48.579421Z","title":"The lean 4 theorem prover and programming language","venue":null,"work_id":"10520149-3035-4b70-af7f-75fc93180c55","year":2021},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:90bf15252795d41dee8cb3574df12ecfcc5304d2d613c9cc2932eeb083842bff","observation_id":"cda72ea1-a8d5-40d5-b286-9140d1692ed1","resolution":{"observed_at":"2026-05-20T14:03:30.539766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Springer","venue":null,"work_id":"c7e37f17-5973-4d95-b0e6-22e79f456db3","year":2002},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:8be2cccd6645f1e41df211303f43449173419cca11ff85ccd1359a862837c438","observation_id":"5eb10634-a151-440d-8272-581dad1d59e9","resolution":{"observed_at":"2026-05-20T14:03:30.728612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The coq proof assistant reference manual.INRIA, version, 6(11):17–21","venue":null,"work_id":"8585632d-591e-4b4a-b865-00dc27c3d140","year":1999},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:e54f58202c05fa310adce10728ecfc7f65489a1854a61031c120cc25a122920c","observation_id":"21fc1540-a925-4619-a328-ede39c140e8f","resolution":{"observed_at":"2026-05-20T14:03:30.677897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Leandojo: Theorem proving with retrieval-augmented lan- guage models.Advances in Neural Information Processing Systems, 36:21573–21612","venue":null,"work_id":"20a579ee-6519-48b0-bd0a-55358d22fb44","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:41c1c457bfaef1bc258a3d5f621d3301080c86106c18bf8cfa7d87c5f26fb092","observation_id":"322c5271-aa46-4c4f-b712-ecfee8c52438","resolution":{"observed_at":"2026-05-20T14:03:30.846274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepseek-prover-v1","venue":null,"work_id":"64b97579-75a5-4e7a-95cd-5941a9542fc9","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:da3e04145f5bd4e71732ed4cb99f8d8f1b5197839d597d372d033a7cd9248e1d","observation_id":"8d4cb0cc-1881-4775-b49b-69a39c5b6cb7","resolution":{"observed_at":"2026-05-20T14:03:30.828921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Theoreml- lama: Transforming general-purpose llms into lean4 experts","venue":null,"work_id":"9b3a4efd-3e27-4ade-b419-e1d88b23f6df","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:ab4c39a616267cfd956cf0babe8a2f3748c7d339ecc0011d43c2e342a4c34b01","observation_id":"fee37aae-b697-445a-acb9-3432d52d0b60","resolution":{"observed_at":"2026-05-20T14:03:30.848348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21801","last_updated":"2025-07-18T08:20:23Z","snapshot_observed_at":"2026-08-02T11:46:58.603316Z","submitted_at":"2025-04-30T16:57:48Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","version":2},"cited_work":{"arxiv_id":"2504.21801","doi":"10.48550/arxiv.2504.21801","metadata_source":"pith","pith_arxiv_id":"2504.21801","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-Prover-V2: Advancing Formal Mathematical Reasoning via Reinforcement Learning for Subgoal Decomposition","venue":"cs.CL","work_id":"3579ad7c-ab73-41db-801b-bf86628c5c02","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2504.21801","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:4b67b3776fb17838dd9bf8543b38d337efb81e381f5ca06360b61bcdadb9a071","observation_id":"cdc54fab-8aca-4236-be74-d2fec9198d4b","resolution":{"observed_at":"2026-05-20T10:58:14.404450Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T04:49:13.361719+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T04:49:13.361719+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11354","last_updated":"2025-04-15T16:23:44Z","snapshot_observed_at":"2026-08-03T03:38:06.953412Z","submitted_at":"2025-04-15T16:23:44Z","title":"Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2504.11354","doi":"10.18653/v1/2025.acl-long.1565","metadata_source":"pith","pith_arxiv_id":"2504.11354","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning","venue":"cs.AI","work_id":"0ff53eb8-7b88-4c00-8ba0-5f90f9a97f90","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2504.11354","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:05a4a30b9b087c0e8b8c00e0a7522439d2ac8b4af93e199f9f35631fd05e109b","observation_id":"f8de2b03-5ae1-479b-824b-0d8c99637418","resolution":{"observed_at":"2026-05-20T10:58:14.386753Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T16:19:43.22822+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T16:19:43.22822+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03613","last_updated":"2025-08-05T16:28:22Z","snapshot_observed_at":"2026-08-02T23:39:36.635461Z","submitted_at":"2025-08-05T16:28:22Z","title":"Goedel-Prover-V2: Scaling Formal Theorem Proving with Scaffolded Data Synthesis and Self-Correction","version":1},"cited_work":{"arxiv_id":"2508.03613","doi":"10.48550/arxiv.2508.03613","metadata_source":"pith","pith_arxiv_id":"2508.03613","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Goedel-Prover-V2: Scaling Formal Theorem Proving with Scaffolded Data Synthesis and Self-Correction","venue":"cs.LG","work_id":"cfdb69bb-3c0b-41d3-bd34-3167a6931bb2","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2508.03613","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:9ec3505548ad7adb25d289f51713fb450835c08862405c1cc97901a31597fadb","observation_id":"549db9fb-e20e-493e-b34c-404cd30bc56c","resolution":{"observed_at":"2026-05-21T06:53:10.886894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T04:49:11.143969+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T04:49:11.143969+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Let’s reason formally: Natural-formal hybrid reasoning enhances llm’s math capability","venue":null,"work_id":"1261decb-47b2-4737-9224-f08003f55e1a","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:497e6e552680ddda2d84520503a5d1027f4eefff85e80bc86e64e7d413ace015","observation_id":"6f46de49-0b3a-457b-ba3f-3d54fa207d40","resolution":{"observed_at":"2026-05-20T14:03:30.592972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.26094","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lean4physics: Comprehensive reasoning framework for college-level physics in lean4","venue":null,"work_id":"8f100cf3-c402-438e-aeee-02ec85141928","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:3de5a9aeee63f6a9384abc7f48557e3b3a2b0926f2c99f04c9489126ea18a8dc","observation_id":"a9318171-fd31-401c-8fae-14ecc7c4f5ea","resolution":{"observed_at":"2026-05-20T10:58:14.316100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Physlib: The lean physics library","venue":null,"work_id":"7bac3de4-e0c4-4e03-bf78-606b07275813","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:0971999811ebee849379a00d6e6bc52153cf329feac86e83f6734ea565e5c0a9","observation_id":"118a986b-1963-4640-a0a2-1a0e78c39f6d","resolution":{"observed_at":"2026-05-20T14:03:30.685476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.23135","doi":"10.48550/arxiv.2505.23135","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VERINA: Bench- marking Verifiable Code Generation","venue":"ArXiv.org","work_id":"a11948de-0db3-4ba9-9a9c-ad2a8f304154","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:7125cf5cf099bd97a6067719a1f54312b7a82b4d855b74cfc0ff278aedb6bb0b","observation_id":"1195e4fd-ee45-4d3a-b61d-1e22765334a0","resolution":{"observed_at":"2026-05-20T10:58:14.333428Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.19329","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T22:19:00.426121Z","title":"Goedel-code-prover: Hierarchical proof search for open state-of-the-art code verification","venue":null,"work_id":"14ce7cf2-71d1-44c1-871c-74c74fd4276c","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:16675ff3e37d675941ff784671c67114c754c144d7c4b06d1f1720926f813254","observation_id":"151f3cc4-2746-42ff-8ab5-311c351fc141","resolution":{"observed_at":"2026-05-20T10:58:14.361102Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lean4agent: Formal modeling and verification for agent workflow and trajectory.Preprint","venue":null,"work_id":"bb04053f-b914-4c41-aeb9-fd46fbed3ca7","year":2026},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:b39f8a3dde573e23b01d50b0e292202200dadf623973ccb3a3f4ea0b64e560e0","observation_id":"85bcb230-f0be-4e03-b59a-0e173d83088a","resolution":{"observed_at":"2026-05-20T14:03:30.789740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05703","last_updated":"2025-02-10T14:42:13Z","snapshot_observed_at":"2026-07-06T20:48:45.592525Z","submitted_at":"2025-02-10T14:42:13Z","title":"What I cannot execute, I do not understand: Training and Evaluating LLMs on Program Execution Traces","version":1},"cited_work":{"arxiv_id":"2503.05703","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.05703","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"What i cannot execute, i do not understand: Training and evaluating llms on program execution traces","venue":null,"work_id":"50d81609-0c3b-4542-aebc-c181b866f61a","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2503.05703","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:be718f5c7e283f722f5704b13180a2f87327f37a9e011b6cd3009ec1a5a0ddb6","observation_id":"7fb5fcd8-e0e4-4af4-9697-72fef103eb5b","resolution":{"observed_at":"2026-05-20T10:58:14.560624Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15118","last_updated":"2025-06-06T12:13:42Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:59:42Z","title":"Reasoning Through Execution: Unifying Process and Outcome Rewards for Code Generation","version":2},"cited_work":{"arxiv_id":"2412.15118","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.15118","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasoning through execution: Unifying process and outcome rewards for code generation","venue":null,"work_id":"0a52077f-89ee-4f03-8263-fff7b923840e","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2412.15118","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:290130fa96d5894a42406746f00ee03fb1ac39d5e146910845be196f5f5acfc8","observation_id":"76e3a7e2-e4c0-4404-9ab0-152fada9cb12","resolution":{"observed_at":"2026-05-20T10:58:14.257707Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cycle: Learning to self-refine the code generation.Proceedings of the ACM on Programming Languages, 8(OOPSLA1):392–418","venue":null,"work_id":"d93f2b04-64ed-4f89-8d29-b9460a7bbf93","year":2024},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:ae31bcb3b743ae01e59a3277ed81ee371fb0db09466a94ac5aa23c2045d8bee3","observation_id":"deba4a20-6d3b-4da8-b1a3-f9a0f8d22bc2","resolution":{"observed_at":"2026-05-20T14:03:30.787244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-edit: Fault-aware code editor for code generation","venue":null,"work_id":"318e3651-eef8-4448-b9ec-3116b6c4b70f","year":2023},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:512781f9d0fb30b3053f5ea52774587430227161c4794b56c9a3b4da571243ec","observation_id":"7c16632a-bd9b-43bb-bca8-d0ff18f47451","resolution":{"observed_at":"2026-05-20T14:03:30.785656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Coderl: Mastering code generation through pretrained models and deep reinforcement learning.Advances in Neural Information Processing Systems, 35:21314–21328","venue":null,"work_id":"7f1857e3-599e-4e46-8b59-fbb9d4f98ac8","year":2022},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:b498e85c64d0a70b7c9bf38a5e46c4fb7a424b8291f8b961f11b13c437525245","observation_id":"4a5a02cc-0a66-4ae8-8568-344510e5231b","resolution":{"observed_at":"2026-05-20T14:03:30.690557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.18471","last_updated":"2026-04-22T14:35:52Z","snapshot_observed_at":"2026-08-02T15:24:09.026985Z","submitted_at":"2025-10-21T09:48:06Z","title":"CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment","version":2},"cited_work":{"arxiv_id":"2510.18471","doi":"10.48550/arxiv.2510.18471","metadata_source":"pith","pith_arxiv_id":"2510.18471","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"CodeRL+: Improving Code Generation via Reinforcement with Execution Semantics Alignment","venue":"cs.SE","work_id":"f48fa717-2e45-4d03-a1ee-0a89c02f3c3a","year":2025},"citing_paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-20T10:54:54.558241Z"},"links":{"cited_paper":"/paper/2510.18471","citing_paper":"/paper/2605.18747"},"observation_digest":"sha256:adf978234b337e5979d2d572c306f23b3a96477e7a4027781e0d1225e1ca7b5f","observation_id":"7c6a563f-8d8c-4ba8-ad5f-9cff54d5c9dc","resolution":{"observed_at":"2026-05-20T10:58:14.219194Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.18747","last_updated":"2026-05-18T17:59:03Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:29:33.702647Z","submitted_at":"2026-05-18T17:59:03Z","title":"Code as Agent Harness"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":45,"verified_fuzzy":51},"total_outbound_references":296},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 100 of 296 outbound references and 20 inbound Pith citation observations for arXiv:2605.18747."}