{"as_of":"2026-08-06T03:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6e24a1f44aee1895424908c896cd257b6c33de4348ebea564fe0a4918d644b2f","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T20:45:28.467576Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.26186/citation-record","integrity":"/paper/2605.26186/integrity","json":"/paper/2605.26186/citation-record.json","paper":"/paper/2605.26186"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-07-06T16:01:07.532053Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":"2308.00352","doi":"10.48550/arxiv.2308.00352","metadata_source":"pith","pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","venue":"cs.AI","work_id":"891b9780-a800-4e3c-bba0-53597ab8dc98","year":2023},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:56d04270aed07b34df693747c1ce546b27da6865ed9130bc788c1c9aedcdbd0e","observation_id":"9b2b491d-7837-4815-91ca-ce8d6dd5de86","resolution":{"observed_at":"2026-06-29T21:03:58.914947Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"Swe-agent: Agent-computer interfaces enable automated software engineering,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:f7cf4a7e909dd5a73ecc131c6ff0aca4beb4aed62af73037c026c5db7b70e8a6","observation_id":"eb2629ea-1858-4971-9b9f-a65429ad1649","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"Swe-bench: Can language models resolve real-world github issues?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:66364c3f5dc9b2ca7e9429818aaff00cd651410399c77422243ff4c5c5cc0499","observation_id":"7dc41e3e-36f6-445d-9e51-b3364ccb29c0","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19856","last_updated":"2024-05-30T09:03:42Z","snapshot_observed_at":"2026-07-06T18:22:31.384923Z","submitted_at":"2024-05-30T09:03:42Z","title":"DevEval: A Manually-Annotated Code Generation Benchmark Aligned with Real-World Code Repositories","version":1},"cited_work":{"arxiv_id":"2405.19856","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.19856","snapshot_observed_at":"2026-07-09T00:25:48.479134Z","title":"Deveval: A manually-annotated code generation benchmark aligned with real-world code repositories","venue":"cs.CL","work_id":"e11628e0-46f5-4825-a3f5-83092f73a432","year":2024},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"cited_paper":"/paper/2405.19856","citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:695428734683c3cb49b7b840460df04b646631f0714adcc2f9300c4c5439f7c3","observation_id":"34328fde-a18a-4c41-b81d-22c38546b37a","resolution":{"observed_at":"2026-06-29T21:03:58.917810Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"Claude code,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:d7f0682134ea2a725f5f13594695f4cfe85a04eb18e30150608c433b0b1bfb3d","observation_id":"59985896-1b96-4f1f-afc9-8659cf39529c","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"Openhands: An open platform for AI software developers as generalist agents,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:17169dcac71b0a9fee6a964504b829c95d6bf2dc577965419d514ae32d33dec4","observation_id":"cf1a3a7f-948b-4b53-ace0-5482ed263547","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"Repo2run: Automated building executable environment for code repository at scale,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:83fa593323e7de296316865d5cbe66faf2d7aeb57440fd4045f166d2b0fe0abe","observation_id":"31f9ccdf-b831-430a-90f4-5f374def14c1","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3728922","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"You name it, i run it: An llm agent to execute tests of arbitrary projects.Proc","venue":"Proceedings of the ACM on software engineering.","work_id":"f2a85bed-02ea-4263-9a6f-96ac0d33777d","year":2025},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:3f8047f85ec36e181852ad030785bc02528ec40c8eaeb98b3dee05bea391c8e5","observation_id":"e40166df-c80c-441d-8b0c-c322d5afb3f5","resolution":{"observed_at":"2026-06-29T20:53:57.662591Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-24T07:53:09.60917+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T07:53:09.60917+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14443","last_updated":"2025-03-18T17:19:12Z","snapshot_observed_at":"2026-07-06T20:54:50.337775Z","submitted_at":"2025-03-18T17:19:12Z","title":"EnvBench: A Benchmark for Automated Environment Setup","version":1},"cited_work":{"arxiv_id":"2503.14443","doi":"10.48550/arxiv.2503.14443","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.14443","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Envbench: A benchmark for automated environment setup","venue":"arXiv (Cornell University)","work_id":"d76b3e0a-08bc-49db-bd44-f7772ec39f90","year":2025},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"cited_paper":"/paper/2503.14443","citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:81eacaaf5110f0ba736ccec419d8d80eafd31fa2e183b4bae43aedd1b00189f8","observation_id":"961c8854-b4c7-4792-a58b-112eb0e95028","resolution":{"observed_at":"2026-06-29T20:53:57.665631Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"Reflexion: language agents with verbal reinforcement learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:f199941eded3457fb450a3c78f407b6a94313a70c198dcd424aa843a50ad7492","observation_id":"c24be4f8-e7eb-42fc-a487-70a968211f6e","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v38i17.29936","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"target_host","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"c24b39e1-f015-4853-8a4f-a92f625168dd","year":2024},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:35a72ec2c0992ecc4feb4e61e797dfc5fc5f265649ef62369d9a0a54953daae8","observation_id":"6acacab6-4f44-4933-ac0c-eec93f3bbdde","resolution":{"observed_at":"2026-06-29T20:53:57.670031Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-01T10:38:13.730438+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T10:38:13.730438+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"V oyager: An open-ended embodied agent with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:3b69d9ad3b83a3654964cb6e26ccfcb5d6724248d1ff4f145127082f4a54e0f1","observation_id":"e21e4e6a-9cd0-43f3-9c77-44c464f6a409","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.00718","doi":"10.48550/arxiv.2603.00718","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Skillcraft: Can llm agents learn to use tools skillfully?","venue":"arXiv (Cornell University)","work_id":"9e9f02e9-ce7d-489b-be81-2ea1513b2c41","year":2026},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:25587c4531b5763a5d0f021bf4878438b2d9609e4bafb0eebd61387d3f6c750e","observation_id":"f232fd31-0a85-49da-86b4-a301b789eed2","resolution":{"observed_at":"2026-06-29T20:53:57.656634Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"React: Synergizing reasoning and acting in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:661ea36690a29dbee38ff67cb33f0fe0a69b0136e82404a59e1a6da015b971b9","observation_id":"54ad0a99-929d-4b1c-93f5-84408426087a","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"Available: https://openreview.net/forum?id=WE_vluYUL-X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:4788061603a9b9e5b90c11f663646871ca98493c034dfb7b2260525d7b48c023","observation_id":"eceac99e-1116-4da3-9a0b-e2deeb70ff80","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11073","last_updated":"2019-07-26T01:59:41Z","snapshot_observed_at":"2026-08-02T09:16:36.269821Z","submitted_at":"2019-07-25T14:11:32Z","title":"An Empirical Analysis of the Python Package Index (PyPI)","version":2},"cited_work":{"arxiv_id":"1907.11073","doi":"10.48550/arxiv.1907.11073","metadata_source":"pith","pith_arxiv_id":"1907.11073","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"An Empirical Analysis of the Python Package Index (PyPI)","venue":"cs.SE","work_id":"2fead51a-c42e-4fcb-9386-138c0a1abc67","year":2019},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"cited_paper":"/paper/1907.11073","citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:3a231fff74eb03332da0f5bba4eb14b9c6306f194ae4a411b0a8bbc91b039661","observation_id":"2b8e2704-133c-4893-85e5-443d0a391d3b","resolution":{"observed_at":"2026-06-29T21:03:58.912050Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7811.338042","doi":"10.1145/3377811.3380426","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Watchman: monitoring dependency conflicts for python library ecosystem,","venue":null,"work_id":"e38bc3ab-ef15-48a4-9812-571b4643bc9e","year":2020},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:9dd5dd83e448e91b4330e53c828927d7d48041c254b34b69dd61620fcfaef77f","observation_id":"e078121e-c780-4c18-95ce-40c485678311","resolution":{"observed_at":"2026-06-29T20:53:57.659211Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0212.368038","doi":"10.1145/3650212.3680381","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In Proceedings of the 33rd ACM SIGSOFT International Symposium on Software Testing and Analysis (Vienna, Austria) (ISSTA 2024)","venue":null,"work_id":"89646ac3-6811-4a11-9005-7942fb6e88d7","year":2024},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:1b81549baca6f15b4f21ae9eb02dd5591dd7a5a9f818684d050af849b4b1c968","observation_id":"759388df-a273-436d-b435-81e90df20215","resolution":{"observed_at":"2026-06-29T20:53:57.656480Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.702","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SUPER: Evaluating Agents on Setting Up and Executing Tasks from Research Repositories","venue":null,"work_id":"d7243cc4-fd1d-4b98-a1a4-38fe8c50180f","year":2024},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:096b6803d33debb03b9623e3a5d8fc75c78a42ce055d54f84ed8f17b85e53da4","observation_id":"9873f04d-a5a0-42b7-a37b-3260226fa273","resolution":{"observed_at":"2026-06-29T20:53:57.658215Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2507.06229","doi":"10.48550/arxiv.2507.06229","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agent kb: Leveraging cross-domain experience for agentic problem solving","venue":"ArXiv.org","work_id":"11232777-9790-41f1-ae97-5d0c1577d5a0","year":2025},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:5fb62024759caa468076005b9a6275914d69d9bc4c4963982ba7857ad54f3f86","observation_id":"f29fb03f-8486-4e86-96fb-31b8793dbfbc","resolution":{"observed_at":"2026-06-29T20:53:57.660768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.16079","last_updated":"2026-05-16T02:57:47Z","snapshot_observed_at":"2026-08-05T00:54:36.690304Z","submitted_at":"2025-10-17T12:03:16Z","title":"EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle","version":3},"cited_work":{"arxiv_id":"2510.16079","doi":"10.48550/arxiv.2510.16079","metadata_source":"pith","pith_arxiv_id":"2510.16079","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle","venue":"cs.CL","work_id":"350af93c-7749-4477-8163-e35d2cac8d96","year":2025},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"cited_paper":"/paper/2510.16079","citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:68a10f707920079311e54c0e8d5bea6e67267306deeb6796120006753ccc63e9","observation_id":"8ea19aed-dae6-4c17-98a5-5e95b993e193","resolution":{"observed_at":"2026-06-29T20:53:57.650432Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06433","last_updated":"2026-04-15T17:21:59Z","snapshot_observed_at":"2026-07-06T22:10:07.250122Z","submitted_at":"2025-08-08T16:20:56Z","title":"Memp: Exploring Agent Procedural Memory","version":4},"cited_work":{"arxiv_id":"2508.06433","doi":"10.48550/arxiv.2508.06433","metadata_source":"pith","pith_arxiv_id":"2508.06433","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Memp: Exploring Agent Procedural Memory","venue":"cs.CL","work_id":"7a9faca4-10b1-472d-8fc5-89b683d01851","year":2025},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"cited_paper":"/paper/2508.06433","citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:5a130d8c2da48b5f7c2a0665cf6ff24b430e161b1e7aeba827294f5d3ad0325f","observation_id":"939cb77f-fef7-4230-a923-414ac987471b","resolution":{"observed_at":"2026-06-29T20:53:57.668282Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"CourtEval: A courtroom-based multi-agent evaluation framework,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:282e61da6c309c02c01eab33658ae00dffc4971c387d451505d3ddf3d4373385","observation_id":"b7f1374c-cfcf-4bfa-bb79-39d2e00150e5","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.05111","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:46:28.203038Z","title":"A survey on agent-as-a-judge","venue":null,"work_id":"87fad81b-b92e-4cdd-8ed9-4b3eab319533","year":2026},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:b7d29ef98d7bfe12435609c79ba5578c3c03e337cfabfb36b602658bf6377c89","observation_id":"a513617c-9669-4e2e-91d3-8de925977b8b","resolution":{"observed_at":"2026-06-29T21:03:58.911291Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:6cd00a24a28ff734211387d1dbf3cad9afd87616081b5ee5fac7f82a2891f4f4","observation_id":"8e865f50-def5-4c4e-9f06-2ff091aef855","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:2976f474a93a9b1bd807dfc9e4589fc33ea42d67b5ebeca4abb9f9d901f6d78c","observation_id":"062300b0-d540-49ca-bbc7-e1e661e00ef7","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:d27cb4c96c19af43111053c4992dfc31d5e5ba64af85069ce4697909d867986b","observation_id":"a0fc00fc-3c1c-4986-8c52-1d2c4acba1de","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"thought\":","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:4ea8cfffa6ec7ebe2c8c7a8fe1a08d16fd209aa4b6e8d631acdc0482ee53ac33","observation_id":"bc76e25b-07d8-4fdc-bd6e-8b378072f245","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:367c224c91e917d5e3580cec2b2735fcc1d5f42ca33ce5a7a35126b9f1b37b5a","observation_id":"7fb6a34e-af3b-4d9f-a0c3-281eb5defe75","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"If they are not, the XPU may still be effective","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:2f304f1472f09f131bcefa2fda2794afd0d36be6313f4c9773cd008c4460ed12","observation_id":"06a767ed-0322-468e-be42-83d23f801736","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:6c7edaba584f79545925be791b72bbd68a3b6b6291c3faf04c05ea95afd240b7","observation_id":"5d8a91a7-186a-4a2d-aa7a-4628f35b9915","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"%## Selection rules %1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:32ba8d8a2702e44858ba84152840147cbac44d37c96d7a08631c5f0fc4017bfd","observation_id":"047a0975-1e61-472c-acf0-f1fdd400874d","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:6555877b400b4973163ad5d9f5546608821f688d91c4b54040b6db3f7d526e21","observation_id":"b713ea2a-2b00-427f-9503-6c428be5ef3c","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"(pytest / unittest / tox, ...)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:d90ec85fe42da09877203dab0bb7ce7610f50c94a74ba4d2a1e6a5a7b40d1243","observation_id":"9d707ce8-1595-4a10-b1d9-47dafff4a60f","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:eb69c39d618fa45978b4c72f3de73688bc7f250915e15a2691f04b981920b65c","observation_id":"24fab27c-4ceb-47fc-af65-6ddf1626562d","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:78b56862ebe3080132fe24c896f70e60beaae16afeb8f033d16f125fbce71ed7","observation_id":"6742b597-1796-4500-815b-995c485f5478","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"## Hard constraints (violation invalidates the verdict) - Install no packages","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:800af62fa12c7c1924873ed610c7c1caa0471839d1c0b3f0d2fe0038fc30f38d","observation_id":"05bbe299-bcc6-4131-9390-100e8dd8b6e1","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:206abdb99832c19507b739d811cb105426c95bbcaa50c369edcf6e825038164c","observation_id":"39d34b90-9b2d-422c-8e8b-b3c110ecf56f","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"import <module>","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:8ddb4c17ee1b48a0509031c502d093d29d0b43a70e0cf79bd21bd95d4e3d48a1","observation_id":"85cac611-66b2-43d0-99f0-8784d73b50be","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T20:45:28.467576Z","title":"host repository is cloned but core dependencies are not installed;import fails immediately,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-29T20:45:28.467576Z"},"links":{"citing_paper":"/paper/2605.26186"},"observation_digest":"sha256:af22cb480d81ea8a8ffb97bf3360541755227b61ce7fec622a2dd96492839dfa","observation_id":"6bc177c7-074d-4237-844a-182994d922f4","resolution":{"observed_at":"2026-06-29T20:45:28.467576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2605.26186","last_updated":"2026-05-27T04:01:59Z","latest_version":2,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-03T08:20:20.299524Z","submitted_at":"2026-05-25T08:33:15Z","title":"SetupX: Can LLM Agents Learn from Past Failures in Functionality-Correct Code Repository Setup?"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":26,"verified_exact":12,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2605.26186."}