{"as_of":"2026-08-04T22:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96250c020d4a35870f78e27d8f32a864d999347e3d6dcb3c7824a5ab5f570d82","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T14:11:14.123806Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T05:13:41.885703Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-29T13:13:26.970130Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2604.04901","last_updated":"2026-04-06T17:49:31Z","snapshot_observed_at":"2026-07-06T22:53:46.999911Z","submitted_at":"2026-04-06T17:49:31Z","title":"FileGram: Grounding Agent Personalization in File-System Behavioral Traces","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T19:33:57.643549Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2604.04901"},"observation_digest":"sha256:f8ab45c931454657f678caccb8fdbfa7406da586b734b26ccee8f8a8f84ccd85","observation_id":"9eb28bd8-1a4b-47e7-8d5f-f41e92880e3f","resolution":{"observed_at":"2026-05-10T22:45:51.207473Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2604.08963","last_updated":"2026-04-13T05:54:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-10T05:06:38Z","title":"Aligned Agents, Biased Swarm: Measuring Bias Amplification in Multi-Agent Systems","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T17:25:01.741390Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2604.08963"},"observation_digest":"sha256:a51fa2f5c71d8cfb515c79ab438dca23bfef475f81a3ae562da28ff190a58330","observation_id":"25f546a7-df3e-4b3d-b15c-5b6e6dc544ee","resolution":{"observed_at":"2026-05-11T06:51:28.126290Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2605.07214","last_updated":"2026-05-08T04:02:28Z","snapshot_observed_at":"2026-08-02T12:32:35.324467Z","submitted_at":"2026-05-08T04:02:28Z","title":"HMACE: Heterogeneous Multi-Agent Collaborative Evolution for Combinatorial Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T01:49:50.520222Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2605.07214"},"observation_digest":"sha256:a5ce05a0ae9e205e9fcd7b6c27bc928e355f0177b651b5ad845b38d9c10ffd48","observation_id":"25feaea7-7f7c-4832-b4c9-db0c1b886855","resolution":{"observed_at":"2026-05-11T01:50:51.194696Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2605.07711","last_updated":"2026-05-21T08:28:27Z","snapshot_observed_at":"2026-07-30T13:45:02.553757Z","submitted_at":"2026-05-08T13:16:17Z","title":"SimCT: Recovering Lost Supervision for Cross-Tokenizer On-Policy Distillation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T10:30:11.309910Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2605.07711"},"observation_digest":"sha256:337aae288bfaaafba8a6909349cbb1b7040d6a8d65c0d65ba051ecb1d5e72a90","observation_id":"11d440ab-8c10-4105-bf2a-f8cc43dba56a","resolution":{"observed_at":"2026-05-22T10:31:24.963224Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2605.13625","last_updated":"2026-05-13T14:52:40Z","snapshot_observed_at":"2026-07-06T23:25:11.623026Z","submitted_at":"2026-05-13T14:52:40Z","title":"How to Interpret Agent Behavior","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-14T18:23:25.269217Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2605.13625"},"observation_digest":"sha256:29b20c5f6300e77eb4a77c24bbd1d6dd8ed765d8c0ec09ee3eed63ea27735608","observation_id":"063b7b09-54da-40bb-b4f5-722bd101cf7a","resolution":{"observed_at":"2026-05-14T18:29:22.787555Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2605.14415","last_updated":"2026-05-14T06:04:40Z","snapshot_observed_at":"2026-07-06T23:25:49.545418Z","submitted_at":"2026-05-14T06:04:40Z","title":"SWE-Chain: Benchmarking Coding Agents on Chained Release-Level Package Upgrades","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-15T02:31:18.183715Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2605.14415"},"observation_digest":"sha256:f215ecb622e4bddeed21293e601f03e86f1e1ffa0224e6ade3c75d5586ad94ef","observation_id":"cca7bfc5-7a43-4f0f-a67b-683ec5c5cfbd","resolution":{"observed_at":"2026-05-15T02:33:32.341560Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2605.15230","last_updated":"2026-08-03T14:38:56Z","snapshot_observed_at":"2026-08-04T21:46:10.829662Z","submitted_at":"2026-05-13T18:03:51Z","title":"EnergyAgentBench: Benchmarking LLM Agents on Live Energy Infrastructure Data","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T17:43:11.038874Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2605.15230"},"observation_digest":"sha256:7aeba4bdf33b86a07136026f85fea8c2011e7ba0a0398afb688fad3d0b4ba8e3","observation_id":"3beacc29-90fc-4724-9f89-e59378a93e46","resolution":{"observed_at":"2026-05-19T17:47:42.057431Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-08-04T05:13:41.885703Z","title":"arXiv preprint arXiv:2601.11044, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.15230","last_updated":"2026-08-03T14:38:56Z","snapshot_observed_at":"2026-08-04T21:46:10.829662Z","submitted_at":"2026-05-13T18:03:51Z","title":"EnergyAgentBench: Benchmarking LLM Agents on Live Energy Infrastructure Data","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T05:13:41.885703Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2605.15230"},"observation_digest":"sha256:cb5944302a277151d8cf11d8a1b5273022d2f775763015d8dc4767385692d245","observation_id":"9cbdcf98-2006-41b7-a88f-a34835be5e04","resolution":{"observed_at":"2026-08-04T05:13:41.885703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2605.27820","last_updated":"2026-05-27T01:28:15Z","snapshot_observed_at":"2026-08-03T07:11:26.941749Z","submitted_at":"2026-05-27T01:28:15Z","title":"EgoBench: An Interactive Egocentric Multimodal Benchmark for Tool-Using Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2605.27820"},"observation_digest":"sha256:26ec5036b6601e8c99a0a66a4350c60af589cf64437287c17d9cd09706e96811","observation_id":"55c7fd09-43b9-42a8-a854-bf5e70a50742","resolution":{"observed_at":"2026-06-29T13:13:26.973796Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":"2601.11044","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-06-29T13:13:26.970130Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","venue":"cs.AI","work_id":"c90d3aba-3953-4c02-b962-79f1a96bda2c","year":2026},"citing_paper":{"arxiv_id":"2605.29790","last_updated":"2026-05-28T11:40:16Z","snapshot_observed_at":"2026-07-06T23:39:10.583797Z","submitted_at":"2026-05-28T11:40:16Z","title":"Evolve as a Team: Collaborative Self-Evolution for LLM-based Multi-Agent Systems","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-29T00:05:31.780655Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2605.29790"},"observation_digest":"sha256:c5b45dda86df8725f3d7a9e840f02ada3beefc885479774ce4c8605fea536a0c","observation_id":"0b953be4-78cd-4e97-a45a-f88b7bf53ccd","resolution":{"observed_at":"2026-06-29T00:12:50.159278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-07-31T23:11:45.425149Z","title":"arXiv preprint arXiv:2601.11044 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24063","last_updated":"2026-07-29T12:23:50Z","snapshot_observed_at":"2026-08-01T23:36:17.408569Z","submitted_at":"2026-07-27T07:05:11Z","title":"The Cost of Knowing: A Resource-Aware Protocol for Benchmarking Hallucination Beyond Static Leaderboards","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-07-31T23:11:45.425149Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2607.24063"},"observation_digest":"sha256:c327045885814ad90614d9703f6f7913aad64feeec99a057013c350bc4f70182","observation_id":"88d46761-5626-43db-bf1a-08836c3915f4","resolution":{"observed_at":"2026-07-31T23:11:45.425149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.11044","snapshot_observed_at":"2026-07-31T23:06:24.702775Z","title":"Agencybench: Benchmarking the frontiers of autonomous agents in 1m-token real-world contexts.arXiv preprint arXiv:2601.11044, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.24101","last_updated":"2026-07-29T12:52:15Z","snapshot_observed_at":"2026-08-03T08:34:41.071327Z","submitted_at":"2026-07-27T07:40:34Z","title":"LU-500: A Logo Benchmark for Concept Unlearning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-31T23:06:24.702775Z"},"links":{"cited_paper":"/paper/2601.11044","citing_paper":"/paper/2607.24101"},"observation_digest":"sha256:dacaddfe2574aad888b5de64ae4cae8406296dbe8f938ea983b43d05c4422285","observation_id":"e87e7e36-1b36-4d65-b35e-eed4dc64a240","resolution":{"observed_at":"2026-07-31T23:06:24.702775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2601.11044/citation-record","integrity":"/paper/2601.11044/integrity","json":"/paper/2601.11044/citation-record.json","paper":"/paper/2601.11044"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.16741","last_updated":"2025-04-18T18:14:31Z","snapshot_observed_at":"2026-08-02T14:58:44.167588Z","submitted_at":"2024-07-23T17:50:43Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","version":3},"cited_work":{"arxiv_id":"2407.16741","doi":"10.1145/3718958.3750537","metadata_source":"pith","pith_arxiv_id":"2407.16741","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"OpenHands: An Open Platform for AI Software Developers as Generalist Agents","venue":"cs.SE","work_id":"f1762ea0-e382-4f38-a28c-adc643789859","year":2024},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"cited_paper":"/paper/2407.16741","citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:3796abf31f6445fbe2ac625dbd6511e36ccaa4eb65e6a4fda507cb51f29063b5","observation_id":"8a028209-3bed-4162-9de5-2ce15bce74e3","resolution":{"observed_at":"2026-05-16T14:12:58.683087Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12516","last_updated":"2025-04-16T22:27:45Z","snapshot_observed_at":"2026-08-03T00:43:33.338074Z","submitted_at":"2025-04-16T22:27:45Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","version":1},"cited_work":{"arxiv_id":"2504.12516","doi":"10.48550/arxiv.2504.12516","metadata_source":"pith","pith_arxiv_id":"2504.12516","snapshot_observed_at":"2026-07-11T03:27:46.323996Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","venue":"cs.CL","work_id":"25adb508-d97c-49d6-ae43-7a70c2478a34","year":2025},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"cited_paper":"/paper/2504.12516","citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:0c95621a44026e1adf8c5053734e232e0449e131e72f8f75398f47f2b7bbb48b","observation_id":"bde73516-2ff7-4988-a70d-eb795dfe8342","resolution":{"observed_at":"2026-05-16T14:12:58.699728Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.27598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T08:23:15.799022Z","title":"Innovatorbench: Evaluating agents’ ability to conduct innovative LLM research.arXiv preprint","venue":null,"work_id":"4d76ef73-0b3a-42cc-80bf-432d2ab28422","year":2025},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:7f3cce0e898a83fcb327907a208570dcc1561dda0ec706543249b61b3e6045dd","observation_id":"17782a1b-4dbf-40e0-8c4d-0020644b9e10","resolution":{"observed_at":"2026-05-16T14:12:58.690621Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.24002","doi":"10.48550/arxiv.2509.24002","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Mcpmark: A benchmark for stress-testing realistic and comprehensive mcp use","venue":null,"work_id":"5b1fa0f7-d604-4d0f-85f2-a2e91356834d","year":2025},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:1b7571d68c63c118043ba2882a7a24df28855acb247b1359f7d4092ab7350df1","observation_id":"c6af2593-b5b5-41ce-a215-477a0847e9f7","resolution":{"observed_at":"2026-05-16T14:12:58.686491Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2d49ca36-7106-485c-843a-f2ff2bba8f48","year":2025},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:35aa96edc093e04bfbab9035d34cc1ba9bccd75ef597bf857aae28d13652eca3","observation_id":"e9af553f-42d7-4bfa-8a16-ab96b077dbb5","resolution":{"observed_at":"2026-05-16T14:12:59.034084Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.17567","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Limi: Less is more for agency.arXiv preprint","venue":null,"work_id":"466fb53d-0a3b-4e3f-8d8f-75f3bdd69960","year":2025},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:8c926b5d1607c13ebeb5486d23258ffec1143e1c8761090533a38abea92b5ff0","observation_id":"cf03ea51-78bc-4b4d-bf65-bcbed040aa26","resolution":{"observed_at":"2026-05-16T14:12:58.693840Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17663","last_updated":"2025-06-08T05:41:33Z","snapshot_observed_at":"2026-07-06T21:29:11.652211Z","submitted_at":"2025-05-23T09:27:40Z","title":"Towards Dynamic Theory of Mind: Evaluating LLM Adaptation to Temporal Evolution of Human States","version":2},"cited_work":{"arxiv_id":"2505.17663","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17663","snapshot_observed_at":"2026-07-01T10:15:44.731812Z","title":"Towards dynamic theory of mind: Evaluating llm adaptation to temporal evolution of human states.arXiv:2505.17663","venue":null,"work_id":"fde89716-a655-4f27-9709-0fe8264e1df6","year":null},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"cited_paper":"/paper/2505.17663","citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:2c3a2e338eb678ba35e529d327647da02f607b14e855a1e1581a65ba40f6c47d","observation_id":"302e4c4a-b98f-41d0-b2c2-a4460ff1fa20","resolution":{"observed_at":"2026-05-16T14:12:58.696860Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.19187","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Limopro: Reasoning refinement for efficient and effective test-time scaling.arXiv preprint arXiv:2505.19187","venue":null,"work_id":"68f83d23-afa2-4621-ba0b-acf456e60e00","year":2023},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:413912465b8cf78ad584c04844eb9469ea5addd3e32581a3b4c49654404d53b3","observation_id":"9b458809-d36a-4fc3-a86d-fd3ac982ae18","resolution":{"observed_at":"2026-05-16T14:12:58.703590Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.00466","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7f5f33f9-a00a-462e-8220-abc8bfe14ce5","year":null},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:e74cb42431ff313273ecabfca008132479cae7b6f7c374675e05db050cc40714","observation_id":"3fa6f6d2-ea48-439d-8e4f-45d2f14cfb0f","resolution":{"observed_at":"2026-05-16T14:12:58.679925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.16280","last_updated":"2025-07-22T06:51:26Z","snapshot_observed_at":"2026-07-06T22:00:52.749944Z","submitted_at":"2025-07-22T06:51:26Z","title":"ResearcherBench: Evaluating Deep AI Research Systems on the Frontiers of Scientific Inquiry","version":1},"cited_work":{"arxiv_id":"2507.16280","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.16280","snapshot_observed_at":"2026-07-03T05:47:41.419232Z","title":"Researcherbench: Evaluating deep ai research systems on the frontiers of scientific inquiry","venue":null,"work_id":"5511bfb9-8ecb-4c5d-a38f-89d73c3a7152","year":2025},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"cited_paper":"/paper/2507.16280","citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:3c996502d4c1eaddff5bba034dca31a5955a4afced64b9ee2a786a8ccd656986","observation_id":"208889a2-d2bb-4ee8-a661-03b1e730bcc3","resolution":{"observed_at":"2026-05-16T14:12:58.706797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:c1ddc3406168776f519b97439bd5bab5cde9ed15069f0a13fbce6068d02c2bcb","observation_id":"41c49cff-a209-4a65-b07d-a5b9fc47a8fb","resolution":{"observed_at":"2026-05-16T14:12:58.709936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4eb94c9d-72e4-4cab-bcb3-02d547d4253f","year":2024},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:68125b068a2068b759346b797313af3c698cbbd7f23aa9c66d67cee2ac4f3e6a","observation_id":"d9dad18d-5173-44d4-b58a-921952485b18","resolution":{"observed_at":"2026-05-16T14:12:59.031447Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"029bf9a7-78d3-42c6-9912-e0cf7c40f358","year":2022},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:f861b4544ae95ada7137726261d3a0dfaa5828d9a74923058c4c43460cf0c67d","observation_id":"aa0157a1-5141-4b7c-86e8-a50c930ac330","resolution":{"observed_at":"2026-05-16T14:12:59.047868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The ”Executors”:There is a striking divergence in how models orient themselves","venue":null,"work_id":"9475f806-e4c6-4bd5-86e3-6b71bb7fd166","year":null},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:36e723700ef696dc8d1377c84334da1d5110bc88a80f4658d002b0800a958efb","observation_id":"8f7bd7f3-2c3f-4277-8917-1ed1dab5203b","resolution":{"observed_at":"2026-05-16T14:12:59.051600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"”Rewriters”:The data reveals a fundamental difference in code modification philosophies","venue":null,"work_id":"e7c85fe0-7cd2-4004-8275-ffb63719d7a4","year":null},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:7e16f63ed9958b14edd456d7f1cc8da280ddfb0eef699c684ceed3d108f4257c","observation_id":"8ae5fdd4-a877-466a-be8f-f8c8749cf1ab","resolution":{"observed_at":"2026-05-16T14:12:59.044603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"It is the only model to record significant usage of update memory bank (22 times) and initialize memory bank (7 times)","venue":null,"work_id":"71c6a7ab-f556-4083-9762-cbbd2747cb48","year":null},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:acad7bb207f0bc317b4dd67236b85f359e9709efc34ced31bed236965db4e038","observation_id":"61d522f0-f39a-4539-a665-2d4144a8ee70","resolution":{"observed_at":"2026-05-16T14:12:59.036469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"score\": 6","venue":null,"work_id":"93aedd66-6448-479a-ad7e-f9172993f422","year":null},"citing_paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T14:11:14.123806Z"},"links":{"citing_paper":"/paper/2601.11044"},"observation_digest":"sha256:1390376a1461e83999107421ed5ab4e4888fc3245b423db4197ef363b56b42c0","observation_id":"99b10aef-6e15-413e-8db4-b27d48cd9f6d","resolution":{"observed_at":"2026-05-16T14:12:59.038886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.11044","last_updated":"2026-04-23T05:01:02Z","latest_version":4,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-30T05:21:46.604291Z","submitted_at":"2026-01-16T07:22:20Z","title":"AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":10,"verified_fuzzy":4},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 12 inbound Pith citation observations for arXiv:2601.11044."}