{"as_of":"2026-08-09T06:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b26d4889a5667945e2429d79362a6347058a702120ef0fa325d0b4b9b4447b9","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T16:46:04.081790Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T07:22:58.072356Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T07:26:03.493470Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"cited_work":{"arxiv_id":"2502.06111","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.06111","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2502.06111 (2025)","venue":null,"work_id":"31fff2f6-fffc-4f43-90a6-fbe1869d2d2e","year":2025},"citing_paper":{"arxiv_id":"2510.13896","last_updated":"2026-05-09T02:53:15Z","snapshot_observed_at":"2026-07-06T22:32:47.087967Z","submitted_at":"2025-10-14T17:02:57Z","title":"GenCellAgent: Generalizable, Training-Free Cellular Image Segmentation via Large Language Model Agents","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-18T07:22:58.072356Z"},"links":{"cited_paper":"/paper/2502.06111","citing_paper":"/paper/2510.13896"},"observation_digest":"sha256:794e4ac7da7ecd3369d27041042cc6e3a897f4c316aa9bf9180ed82a735acdc8","observation_id":"b3f3b627-f1b8-4b77-ba90-bd54edc28f7e","resolution":{"observed_at":"2026-05-18T07:26:03.496507Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.06111/citation-record","integrity":"/paper/2502.06111/integrity","json":"/paper/2502.06111/citation-record.json","paper":"/paper/2502.06111"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:03.834158Z","title":"Agent-101: A software engineering agent for code assistance developed by ibm research","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.834158Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:bb7d7e44492f99d83bc6d0e61edb057f7a35810eba18885f0e21c5a56da21bed","observation_id":"753fd10c-c535-4334-bd78-de73d60b9d29","resolution":{"observed_at":"2026-08-08T16:46:03.834158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:05.167256Z","title":"Amazon q developer the most capable generative ai–powered assistant for software development","venue":null,"work_id":"ab2f0e9f-74a8-40be-95fd-13e554ae42a9","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.839000Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:9b01c4aabcff83d4e7d627ffb7fce4374f342b20789f18d7918cfcd5cde29d4d","observation_id":"29d2e035-1c08-41cd-8139-20c5057d7735","resolution":{"observed_at":"2026-08-08T16:46:05.171961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:05.151836Z","title":"Devin, ai software engineer","venue":null,"work_id":"b81475a7-ccfb-48bb-83d6-58b49155f34c","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.844034Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:28bf86f23423b8f87636597e988a5d3887b090ebaa75681bcb5c2a67d4a78a26","observation_id":"5fd33af2-805d-43ab-a37d-a02f1415f024","resolution":{"observed_at":"2026-08-08T16:46:05.156747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:05.137708Z","title":"Factory bringing autonomy to software engineering","venue":null,"work_id":"7a883b5f-56bf-4b09-bbfd-1deeed8a7c80","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.848725Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:b40c679000fe6aac4f4a71dc55baf87897f806200eefadcee8a5dae9c01180e5","observation_id":"6071f6b2-78c0-471c-9e22-8e487b78f471","resolution":{"observed_at":"2026-08-08T16:46:05.142088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:03.853262Z","title":"Lingma agent","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.853262Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:229cce24fc82c79f4473c8cb1f2f932cb1a2b386aec32b30b151250c2f89b2c0","observation_id":"3c7ccf99-0f30-4e89-97e0-bc48651ec520","resolution":{"observed_at":"2026-08-08T16:46:03.853262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:05.091314Z","title":"Marscode code and innovate faster with ai","venue":null,"work_id":"1bc18cf6-1ba8-4426-b577-820c9f00365f","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.858092Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:01f6330a0c43f79be600bb6644e57d2ea9830d5f15efe576a5135218caf95a32","observation_id":"a97800f3-3fee-4473-b127-4b17f62f6675","resolution":{"observed_at":"2026-08-08T16:46:05.113419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:05.052769Z","title":"Opencsg starship","venue":null,"work_id":"f6cd8201-2c86-42a1-b44a-93a6d28871e2","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.863349Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:1fb2177a1343f28150cb2db2c70d78ec442b3b603254c7799ee72f072cf5ca32","observation_id":"1b4a9753-fb5a-4f7f-9cd5-c4e401b7fcab","resolution":{"observed_at":"2026-08-08T16:46:05.062224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:05.037254Z","title":"Opendevin: Code less, make more","venue":null,"work_id":"098f3913-b410-49e2-86f5-cf7b57f34446","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.868043Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:2e82347fe0a9574d54012b04f4baee588e3bed0b23ba2117f19b1d0049b882ce","observation_id":"af95d016-20b2-418d-93d7-7134984f91da","resolution":{"observed_at":"2026-08-08T16:46:05.042877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:05.022413Z","title":"Swe-bench lite","venue":null,"work_id":"a04c9315-baf6-46d9-af01-c0f50efe2558","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.872695Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:f238099780a2710f3bc4bde0e7233cbe1cbb10da59ce87341f062c9adb4e809e","observation_id":"f807f0c6-b81c-4852-9a17-7a60aa9805f5","resolution":{"observed_at":"2026-08-08T16:46:05.027082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T16:46:03.877206Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.877206Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:a53e2bc70320fc9c281d3574a101b6de22e4f5824d8b3d89c5e87e2b1fd39f67","observation_id":"1f6bfdc6-72ea-48fe-ae16-736c19f3035d","resolution":{"observed_at":"2026-08-08T16:46:03.877206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-08T16:46:03.882241Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.882241Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:bcf82e21bb19c88a45c841018253122e8775169bd311b12d310d2168b93cb513","observation_id":"3767d424-e270-4653-8a0c-be25150aea57","resolution":{"observed_at":"2026-08-08T16:46:03.882241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17134","last_updated":"2024-10-28T17:33:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-25T19:17:43Z","title":"RepairAgent: An Autonomous, LLM-Based Agent for Program Repair","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17134","snapshot_observed_at":"2026-08-08T16:46:03.886478Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.886478Z"},"links":{"cited_paper":"/paper/2403.17134","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:90ccc739cd764f90a2a82e1f060af4d3faa25c43587d54c7addb59f71090a7d2","observation_id":"551d7956-e230-4f4a-8c12-c03a8b547378","resolution":{"observed_at":"2026-08-08T16:46:03.886478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:05.008835Z","title":null,"venue":null,"work_id":"2fafc907-3e3d-402c-ad5b-a92058c52e1a","year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.890633Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:4fb42047cb8e4bc6f99a82a5c3e9eac4f362b93b61f625cd0d0a32c3075b22a8","observation_id":"c820c9f5-c913-41df-9b37-6421d5bf1edc","resolution":{"observed_at":"2026-08-08T16:46:05.012811Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01304","last_updated":"2024-06-11T03:52:03Z","snapshot_observed_at":"2026-08-07T07:27:32.971066Z","submitted_at":"2024-06-03T13:13:35Z","title":"CodeR: Issue Resolving with Multi-Agent and Task Graphs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01304","snapshot_observed_at":"2026-08-08T16:46:03.894687Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.894687Z"},"links":{"cited_paper":"/paper/2406.01304","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:53f7b1d70e9f77a4e0a9fa98f68ed3ec1e4b3fabbee879b87a4f13542fc25ecb","observation_id":"bcf5f192-aa6b-4628-9ad2-1d904993a2db","resolution":{"observed_at":"2026-08-08T16:46:03.894687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-08T16:46:03.899020Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.899020Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:721a212201e6d8fd1dce39befda4ede01bd4c78952a7b13b77bb2fab1aacfe2d","observation_id":"edc0fec3-5edc-4ab1-ba69-9d3658992924","resolution":{"observed_at":"2026-08-08T16:46:03.899020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.994478Z","title":null,"venue":null,"work_id":"0f5552c2-a94a-4ace-ab36-948143c37a4c","year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.903084Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:c622794a429a1b5cd931f9cfd010b266ebcd8076d988321d06dc52e4588efebc","observation_id":"e4dd2642-543b-4f22-a299-78f65a45d708","resolution":{"observed_at":"2026-08-08T16:46:04.998980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.980133Z","title":null,"venue":null,"work_id":"714fa003-e0f4-414a-bf1f-6f8545263def","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.907172Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:420dc3d6d00b14c24a01f3f1c67103cf49a1a1a93a8f4dda827d2e842715278e","observation_id":"18591358-a9e0-483d-8aa6-7176a279ac34","resolution":{"observed_at":"2026-08-08T16:46:04.984054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-08T16:46:03.911257Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.911257Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:23221aefa338665d81793d666b5f9e91085c9095bdd2c7c3d855156fc409dbc8","observation_id":"d25a49da-ad19-4560-968b-5c7793de3b07","resolution":{"observed_at":"2026-08-08T16:46:03.911257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.966189Z","title":null,"venue":null,"work_id":"b96b28b7-194d-4cdb-b968-14a889978aab","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.915925Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:48eecccfa2aca0138ac6c51596309890516f45b5c84e44a9a40ca265ba941d55","observation_id":"70749ee1-ec46-4dfc-990a-246bb95bdec2","resolution":{"observed_at":"2026-08-08T16:46:04.970788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-08T16:46:03.920050Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.920050Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:a1f6ab8a3b4df48b8af87976299ea16886546e28e39ba11783114b971756c37d","observation_id":"b6df78a6-fc65-4bbf-afd3-252327efc130","resolution":{"observed_at":"2026-08-08T16:46:03.920050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.951441Z","title":null,"venue":null,"work_id":"4ed60abc-ce30-4462-b058-66033b162f71","year":2021},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.924635Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:77ac53d7a29cd1e5ee7ea4cd703b33cdfba0477a41dd837473a38c96bed0ad27","observation_id":"4665916e-77e0-4fe2-8f02-c2ad3da5e73a","resolution":{"observed_at":"2026-08-08T16:46:04.956272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-07-06T16:01:07.532053Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-08T16:46:03.928748Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.928748Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:79bc8ee5a44e58efffb1409df9f4fb4ed70d2b2d76d579b929c6c0e32ce96857","observation_id":"6698713b-6d12-4e34-9806-75e664cee2cb","resolution":{"observed_at":"2026-08-08T16:46:03.928748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.937078Z","title":null,"venue":null,"work_id":"563b28cc-2ed5-43da-ab4b-3290c0656ed7","year":2018},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.933089Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:6035d3bff7202618ec2dae42fde2c3c2014db06b7cd55c340b96013f748d6afa","observation_id":"5a51866b-5289-4b49-8722-797fc48c0a90","resolution":{"observed_at":"2026-08-08T16:46:04.941628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.922815Z","title":null,"venue":null,"work_id":"9bb5608a-1b1c-4039-a3b3-b3b6f195f233","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.937204Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:acf2bf4691b993059254cd6485c3450907f89c62c3e8101c4cb0343184d19be2","observation_id":"71dfb7c7-0ce5-4a4d-8c6e-a9b2ab57ade3","resolution":{"observed_at":"2026-08-08T16:46:04.927306Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:03.941362Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.941362Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:e950c2be79b37536c5ceb881d9c8aa51af6301ed62effdf59c8eb0324b2b8239","observation_id":"2cb5680d-4582-4015-90cc-5ec69f0ef595","resolution":{"observed_at":"2026-08-08T16:46:03.941362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:03.945388Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.945388Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:048b0f43e946a9bc5b787cbf4f5ce2ef096d9f9f33c580efc1e1c20a42f7e6c3","observation_id":"6979afad-c3e3-41b6-909e-64b6514d9960","resolution":{"observed_at":"2026-08-08T16:46:03.945388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:03.949612Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.949612Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:354db40b0ae280e30ecad44f8a22d02f4d0ab7784ca5e52c9e059a0b4aff4081","observation_id":"946191f1-a802-4717-bc7b-b2bd7c3ecef7","resolution":{"observed_at":"2026-08-08T16:46:03.949612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.878527Z","title":null,"venue":null,"work_id":"70453322-3294-42c2-aba0-166b629f8fba","year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.953591Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:5ddd76ded262bdc62ff03880631340d1a0877be8d90ea71c7073ccaca0168e98","observation_id":"ab194196-d9a7-433b-8ad9-5faa2d5f790d","resolution":{"observed_at":"2026-08-08T16:46:04.883390Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.864010Z","title":null,"venue":null,"work_id":"2a5f6976-d32f-4a6a-91e1-9639e579688b","year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.957495Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:149decac4d534078b2adf8b01619e73176ee0a2e6dfb89608e2c36df2fb1ff17","observation_id":"5b82f09a-af1c-4d2a-a161-0c92b0f1f05f","resolution":{"observed_at":"2026-08-08T16:46:04.868181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.849887Z","title":null,"venue":null,"work_id":"45d26547-e8de-4f70-a7a5-66ea46886dea","year":2022},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.961509Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:d7132eb36f0f48a16bd451f2af2ade802dd73f0067572a575561e18599feac1f","observation_id":"6ee1367e-bee9-4d51-9593-7585eb8eab90","resolution":{"observed_at":"2026-08-08T16:46:04.854513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:03.965765Z","title":"Mankowitz, Esme Sutherland Robson, Pushmeet Kohli, Nando de Freitas, Koray Kavukcuoglu, and Oriol Vinyals","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.965765Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:d0008cf342b1f77f232bf8711efa41a798dcb7e9177f0bde1ca44ee486de4339","observation_id":"a8cbef5a-e4fd-431c-9719-969583696a7a","resolution":{"observed_at":"2026-08-08T16:46:03.965765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.836540Z","title":null,"venue":null,"work_id":"b173c386-ae53-4658-998a-286e131a2395","year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.969803Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:bcecee0db765a42e9aa6c9b4fab91aca60cda6c33347083ab0a37fa21248362d","observation_id":"c976d7dc-aa5c-414b-a877-87b7e9d4e9d8","resolution":{"observed_at":"2026-08-08T16:46:04.840717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03091","last_updated":"2023-10-04T01:13:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-05T17:59:41Z","title":"RepoBench: Benchmarking Repository-Level Code Auto-Completion Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.03091","snapshot_observed_at":"2026-08-08T16:46:03.974326Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.974326Z"},"links":{"cited_paper":"/paper/2306.03091","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:ab908a5bc44f177560cf1561bc2ff3db1a7004e5479dcc6c290bf6150246150f","observation_id":"d85d3c80-c014-4db3-8852-9e0ad2772dcd","resolution":{"observed_at":"2026-08-08T16:46:03.974326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.822328Z","title":null,"venue":null,"work_id":"379fb744-6f35-4275-83ab-ab09964b645b","year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.979142Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:0a5c5f638ed0ef99e7ff717e315a6d4bb55a264613e14a9e071c61f2c4e85dd6","observation_id":"a55df4ef-bb2b-496e-9676-4fc139db24fb","resolution":{"observed_at":"2026-08-08T16:46:04.826863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.19173","last_updated":"2024-02-29T13:53:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-29T13:53:35Z","title":"StarCoder 2 and The Stack v2: The Next Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.19173","snapshot_observed_at":"2026-08-08T16:46:03.983954Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.983954Z"},"links":{"cited_paper":"/paper/2402.19173","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:9b2989bb21f81cd942581c050dca6098f83d800c08c8cdd7faaf33acdc7a14e7","observation_id":"51392ac2-6c80-4f01-b055-a72455e638a8","resolution":{"observed_at":"2026-08-08T16:46:03.983954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.08568","last_updated":"2025-05-27T07:40:36Z","snapshot_observed_at":"2026-08-04T15:08:40.203853Z","submitted_at":"2023-06-14T15:18:48Z","title":"WizardCoder: Empowering Code Large Language Models with Evol-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.08568","snapshot_observed_at":"2026-08-08T16:46:03.988734Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.988734Z"},"links":{"cited_paper":"/paper/2306.08568","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:5c19f58c1da69ccd1479b27534617080d2c165c200935ac077c0838674b5b099","observation_id":"4daf938b-43a3-4001-9509-1ef7ab0a59f3","resolution":{"observed_at":"2026-08-08T16:46:03.988734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01422","last_updated":"2025-03-26T03:26:09Z","snapshot_observed_at":"2026-08-06T19:36:59.990389Z","submitted_at":"2024-06-03T15:20:06Z","title":"Alibaba LingmaAgent: Improving Automated Issue Resolution via Comprehensive Repository Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01422","snapshot_observed_at":"2026-08-08T16:46:03.993464Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.993464Z"},"links":{"cited_paper":"/paper/2406.01422","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:c27de4ce83df4fd3ca0b605c14b2a3e00632d38bbdf78be75b85a785b6086eb3","observation_id":"4df5666c-2155-4150-8d2d-ac500bf90392","resolution":{"observed_at":"2026-08-08T16:46:03.993464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.807571Z","title":null,"venue":null,"work_id":"0880c1c2-6d35-4a58-b5b3-d7fec77f8ae1","year":2018},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:03.998022Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:6a706bd433b9f24f27b3106d7a81f572fd41d72c1ff7389181a38c4432eec78c","observation_id":"a49c925a-8876-4de3-a39b-0d13f20f9c04","resolution":{"observed_at":"2026-08-08T16:46:04.812028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.002923Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.002923Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:01c5dcece6ffa307736aad8105b133df01626cea0d48629377ec43ecd37aa106","observation_id":"19dad2d1-53e2-4c83-9577-0c76ea61f8b4","resolution":{"observed_at":"2026-08-08T16:46:04.002923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.783470Z","title":null,"venue":null,"work_id":"d2ab126a-2e92-49ed-8a40-d61a0234431f","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.007324Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:8212edf96a57d6aba645678d9a1640b6d10a05d3b7074a538b2188817a78a9c0","observation_id":"ce754184-e7d3-401c-99c6-bb3184c102f5","resolution":{"observed_at":"2026-08-08T16:46:04.788163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-08T16:46:04.011327Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.011327Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:bd1121d589832dd9654f5ed2ec5a496e64fa245b7fd35d9d2e07ab6a00acc56e","observation_id":"3439cbf9-e79d-418b-a192-49bb46f0827e","resolution":{"observed_at":"2026-08-08T16:46:04.011327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.015403Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.015403Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:dd680bbde8ed09e5231dc54c569711c6c646d39dd4a06a37d70ae5aa82d76beb","observation_id":"98c38fc7-610a-4067-881b-f32a604ebec5","resolution":{"observed_at":"2026-08-08T16:46:04.015403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06773","last_updated":"2022-02-16T13:54:26Z","snapshot_observed_at":"2026-08-03T15:39:38.061563Z","submitted_at":"2021-10-13T15:08:43Z","title":"Leveraging Automated Unit Tests for Unsupervised Code Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06773","snapshot_observed_at":"2026-08-08T16:46:04.019496Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.019496Z"},"links":{"cited_paper":"/paper/2110.06773","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:1dd4165e2db3e9f52445df7ead175c12fa251c25837a42068b14069fbf4f7a0b","observation_id":"b8312b59-e4d8-4349-8b0a-6f0db997d4b2","resolution":{"observed_at":"2026-08-08T16:46:04.019496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02120","last_updated":"2024-06-07T02:50:56Z","snapshot_observed_at":"2026-07-06T16:56:46.051958Z","submitted_at":"2023-12-04T18:50:35Z","title":"Magicoder: Empowering Code Generation with OSS-Instruct","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02120","snapshot_observed_at":"2026-08-08T16:46:04.023494Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.023494Z"},"links":{"cited_paper":"/paper/2312.02120","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:4e5a326a0a8f44f56c82483563a106f78ceedcc3c5d50a5b1f5234fe5d4161d9","observation_id":"97e3385a-7082-4138-b4bf-76847e199393","resolution":{"observed_at":"2026-08-08T16:46:04.023494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07864","last_updated":"2023-09-19T08:29:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-14T17:12:03Z","title":"The Rise and Potential of Large Language Model Based Agents: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07864","snapshot_observed_at":"2026-08-08T16:46:04.027598Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.027598Z"},"links":{"cited_paper":"/paper/2309.07864","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:61d26318d16f7284c910c9b201b1c9831b0813aea0fca4b684728df07df838aa","observation_id":"1d0fc3a3-3c2c-4da7-8f9d-199e2bef372b","resolution":{"observed_at":"2026-08-08T16:46:04.027598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01489","last_updated":"2024-10-29T17:29:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-01T17:24:45Z","title":"Agentless: Demystifying LLM-based Software Engineering Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01489","snapshot_observed_at":"2026-08-08T16:46:04.031657Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.031657Z"},"links":{"cited_paper":"/paper/2407.01489","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:9a873b3ee87fbab99d11bcd86454db669c3cb7c296045026829e186b570e7d9b","observation_id":"785faeec-8fc9-45ed-85c7-2d548709fd74","resolution":{"observed_at":"2026-08-08T16:46:04.031657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.758322Z","title":null,"venue":null,"work_id":"833329e9-bd27-460e-8729-f33ccb9afe69","year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.036138Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:87f29ebb278e51e15c59defee16566b93a94e2c14e5cb30511095268d79ee23f","observation_id":"36094ce6-e17e-4193-9a03-76aa3f45d8f0","resolution":{"observed_at":"2026-08-08T16:46:04.763121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.741852Z","title":null,"venue":null,"work_id":"883206e1-a123-4f45-8049-1ee12bb4b063","year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.040471Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:b8a289cd86ac02c2d9f44ccb911bb04a4c62629407a430579029fb2a44ce89ad","observation_id":"735e8acd-a41d-489a-a12e-2d6ce8ea1d97","resolution":{"observed_at":"2026-08-08T16:46:04.747616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.00385","last_updated":"2024-12-09T20:45:33Z","snapshot_observed_at":"2026-08-07T04:08:23.682670Z","submitted_at":"2023-04-01T20:57:33Z","title":"Keep the Conversation Going: Fixing 162 out of 337 bugs for $0.42 each using ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.00385","snapshot_observed_at":"2026-08-08T16:46:04.044769Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.044769Z"},"links":{"cited_paper":"/paper/2304.00385","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:35c7093867b10499e16bc8e830c6e23d0bbdb6ce0d0e63f4ad8a9e5b1066de48","observation_id":"e65bb809-ed2b-4f0e-8cc0-8b95d0c60d7f","resolution":{"observed_at":"2026-08-08T16:46:04.044769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15793","last_updated":"2024-11-11T20:01:15Z","snapshot_observed_at":"2026-07-06T18:19:29.996982Z","submitted_at":"2024-05-06T17:41:33Z","title":"SWE-agent: Agent-Computer Interfaces Enable Automated Software Engineering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15793","snapshot_observed_at":"2026-08-08T16:46:04.049257Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.049257Z"},"links":{"cited_paper":"/paper/2405.15793","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:207f78756644330b160d245b5464d27a2b89a0d326b0fd00a0878f24ac474a2d","observation_id":"e9745207-d94c-4bd6-9eca-5e14650fdf3f","resolution":{"observed_at":"2026-08-08T16:46:04.049257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09248","last_updated":"2022-12-19T05:06:00Z","snapshot_observed_at":"2026-07-06T14:32:14.364330Z","submitted_at":"2022-12-19T05:06:00Z","title":"Natural Language to Code Generation in Interactive Data Science Notebooks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09248","snapshot_observed_at":"2026-08-08T16:46:04.054718Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.054718Z"},"links":{"cited_paper":"/paper/2212.09248","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:3ba49feb6ffeef9d4028df5801cfd80e098229ccb8922e86ae4635ebc8596f52","observation_id":"be8cfd84-c410-4b06-bacd-2aa31b2d4f5e","resolution":{"observed_at":"2026-08-08T16:46:04.054718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12570","last_updated":"2023-10-20T15:21:51Z","snapshot_observed_at":"2026-07-06T15:06:41.938212Z","submitted_at":"2023-03-22T13:54:46Z","title":"RepoCoder: Repository-Level Code Completion Through Iterative Retrieval and Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12570","snapshot_observed_at":"2026-08-08T16:46:04.059419Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.059419Z"},"links":{"cited_paper":"/paper/2303.12570","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:4cc7ec667f546d3baf058b00db714e571a77f662182d3e5b092083d9b484e412","observation_id":"e8ff8696-9a06-4deb-bee9-9cf75d6945e5","resolution":{"observed_at":"2026-08-08T16:46:04.059419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05427","last_updated":"2024-07-25T16:54:41Z","snapshot_observed_at":"2026-07-06T17:57:06.330791Z","submitted_at":"2024-04-08T11:55:09Z","title":"AutoCodeRover: Autonomous Program Improvement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05427","snapshot_observed_at":"2026-08-08T16:46:04.064358Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.064358Z"},"links":{"cited_paper":"/paper/2404.05427","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:5296a1fde03ce9fd87949e7e574f0099352482c1606d07c376a0acd97b64a4fd","observation_id":"cceda816-7ed8-4369-bf58-fc22e73f5592","resolution":{"observed_at":"2026-08-08T16:46:04.064358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17568","last_updated":"2024-07-10T03:52:58Z","snapshot_observed_at":"2026-07-06T15:10:12.213443Z","submitted_at":"2023-03-30T17:34:01Z","title":"CodeGeeX: A Pre-Trained Model for Code Generation with Multilingual Benchmarking on HumanEval-X","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17568","snapshot_observed_at":"2026-08-08T16:46:04.068653Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.068653Z"},"links":{"cited_paper":"/paper/2303.17568","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:cc7c30c12c6ae1215385a6b17e544c24eb5d2d6e8bce3a2edc8134e686e616ef","observation_id":"fe73dc69-b27d-457e-81bf-cf12991d8a48","resolution":{"observed_at":"2026-08-08T16:46:04.068653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14658","last_updated":"2025-01-07T05:37:04Z","snapshot_observed_at":"2026-08-06T03:14:31.781649Z","submitted_at":"2024-02-22T16:06:23Z","title":"OpenCodeInterpreter: Integrating Code Generation with Execution and Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14658","snapshot_observed_at":"2026-08-08T16:46:04.072853Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.072853Z"},"links":{"cited_paper":"/paper/2402.14658","citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:dc175b8a675195e18bd91440ceb509f7ed0543bda4b7c12ef925dc31a3066f7c","observation_id":"1792b19c-0e48-40df-a745-98bb6ebf3bbc","resolution":{"observed_at":"2026-08-08T16:46:04.072853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.077275Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.077275Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:ac78b421a35e2c97101c9027ec490e17bd78f32d113bbe8d973dce512d7d8bb3","observation_id":"88625d5e-5bdd-4c87-b8a7-1b6e21aca5d3","resolution":{"observed_at":"2026-08-08T16:46:04.077275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T16:46:04.081790Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-08T16:46:04.081790Z"},"links":{"citing_paper":"/paper/2502.06111"},"observation_digest":"sha256:4778b8ea236eb97189b3264dca9803bf6b579f8b184a8282c20bd3aff6b62acc","observation_id":"c8d38601-a52e-4131-a368-b3b431ca0b2e","resolution":{"observed_at":"2026-08-08T16:46:04.081790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.06111","last_updated":"2025-02-11T20:25:11Z","latest_version":2,"primary_category":"cs.SE","snapshot_observed_at":"2026-08-08T16:40:56.168676Z","submitted_at":"2025-02-10T02:46:29Z","title":"CSR-Bench: Benchmarking LLM Agents in Deployment of Computer Science Research Repositories"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":50,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 1 inbound Pith citation observation for arXiv:2502.06111."}