{"as_of":"2026-08-18T11:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:94ebe73d3a20388100a8227b1408ffbf1c2becc79664130fa133f4154db12443","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:34:41.352899Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-30T10:50:07.915199Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.19865","snapshot_observed_at":"2026-07-30T10:50:07.915199Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27155","last_updated":"2026-07-29T17:33:47Z","snapshot_observed_at":"2026-08-17T06:57:54.624737Z","submitted_at":"2026-07-29T17:33:47Z","title":"OmegaUse-OfficeVal: Benchmarking LLM Agents on Long-Horizon Office-Suite Tasks with Economic Grounding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-30T10:50:07.915199Z"},"links":{"cited_paper":"/paper/2607.19865","citing_paper":"/paper/2607.27155"},"observation_digest":"sha256:f763860f885fc6b8e9c5819e4696cbe47a23683dceaef289aad809399547950f","observation_id":"20a0ccc6-ed99-46d3-8d2c-fb892884672b","resolution":{"observed_at":"2026-07-30T10:50:07.915199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.19865/citation-record","integrity":"/paper/2607.19865/integrity","json":"/paper/2607.19865/citation-record.json","paper":"/paper/2607.19865"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:33.428554Z","title":", title =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:33.428554Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:10a76f5ea843eebb7d6dbafbf4afcd80b547d43839bc7f2074c99f2ea8b00115","observation_id":"ff01524a-e836-48b6-89fb-9e9dc1dc1c49","resolution":{"observed_at":"2026-08-01T11:34:33.428554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:33.600573Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:33.600573Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:2ecfea65aa359e92cc45da03281f5316fe32b9e27348607c7f2d182f9cda807c","observation_id":"ec24873b-7d77-4639-89da-b5d0202b403a","resolution":{"observed_at":"2026-08-01T11:34:33.600573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:33.823189Z","title":", title =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:33.823189Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:bafb89ffa6a1bd40f6d4f6ebf33bd65d6669bfa918df4051e91aecfd3c94f9b0","observation_id":"b7f35ce1-03d8-4e62-b0a7-d1173a19a485","resolution":{"observed_at":"2026-08-01T11:34:33.823189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:33.982715Z","title":"C hart QA : A Benchmark for Question Answering about Charts with Visual and Logical Reasoning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:33.982715Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:920c2b5870186903d605ab3755d7ba38d8b42bf7079a67b61ac22adc6b2259fc","observation_id":"e5894e3b-87f4-4c48-8c78-86a004e24596","resolution":{"observed_at":"2026-08-01T11:34:33.982715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:34.113138Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:34.113138Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:1f8ef5cddd73d22b3f15d00b1f1acf1ec44fd02d66fa39d03452a6c0075e2b81","observation_id":"f36af754-cbb8-4b0f-8c45-5f954c171a56","resolution":{"observed_at":"2026-08-01T11:34:34.113138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:34.252140Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:34.252140Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:4d53a44e21b769af56c2b443581832554d4389974e823760b874f6fe496f2e39","observation_id":"4899c572-32e6-4649-974b-d22ce93daa0e","resolution":{"observed_at":"2026-08-01T11:34:34.252140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:34.500144Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:34.500144Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:2ef4a943f77138794d17696e8736f7420c6012987f1665b2048d8221f95f3bf4","observation_id":"ef848ab8-90cc-4029-86ec-057714e49b2e","resolution":{"observed_at":"2026-08-01T11:34:34.500144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:34.758382Z","title":"2026 , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:34.758382Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:71925dfc0632c8369cd973ab1cf7f5a078669de64f7bd9359c8bec4126824b7f","observation_id":"62c0896d-cda9-4a3c-9a3d-0b1f32879ffd","resolution":{"observed_at":"2026-08-01T11:34:34.758382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:34.949090Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:34.949090Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:683ab15f187c5010f594aa60545418c1d86e462e7d3edcc30462b17b721fd946","observation_id":"a54b18fa-b16e-42ae-ba10-656b92a4aad3","resolution":{"observed_at":"2026-08-01T11:34:34.949090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-3041","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MMLONGBENCH-DOC: Benchmarking Long-context Document Understanding with Visualizations , url =","venue":null,"work_id":"82bf6672-f936-4376-9010-867657ba0484","year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:35.044054Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:caf04326c701ce85f3a9586c69dc60313ea77fc8770e26b355bce312c4b48e56","observation_id":"03096d2d-1418-48cb-8b0e-8bd7d64f62d8","resolution":{"observed_at":"2026-08-01T11:38:34.507365Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:35.248661Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:35.248661Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:734d2435cb1dc44fdbd0f408beed2867d67d452d069077b2f30a440f1d545cf7","observation_id":"aa246bc7-6c50-4fc8-a5a2-b49497ba4eb4","resolution":{"observed_at":"2026-08-01T11:34:35.248661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:35.421104Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:35.421104Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:49190f2cec9188c1aa0a582209f669eb954982bf756464122c6d0c2db4b2ba33","observation_id":"885ac208-866d-46d6-b65a-8daa798b168a","resolution":{"observed_at":"2026-08-01T11:34:35.421104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:35.607452Z","title":"SheetCopilot: Bringing Software Productivity to the Next Level through Large Language Models , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:35.607452Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:dd2942ac87f6273c298426475c2b92b6884d94de4446106535f40e9b06ddadb6","observation_id":"20eafb6f-6698-47e4-a866-86ac9634987b","resolution":{"observed_at":"2026-08-01T11:34:35.607452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.265","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"I nstruct E xcel: A Benchmark for Natural Language Instruction in Excel","venue":null,"work_id":"fe15ec9a-06ff-44b1-aff1-4514a594e94c","year":2023},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:35.802005Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:5f44760d3558c91577b16ea3b5fb10f9c138fda2ec420d5566535152d03229d1","observation_id":"3caf5df0-e8ac-4625-b112-bfddeb012b29","resolution":{"observed_at":"2026-08-01T11:38:34.277891Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:35.933912Z","title":"SpreadsheetBench: Towards Challenging Real World Spreadsheet Manipulation , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:35.933912Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:6416c69a0942e492cb53fe621bbdc5bb882d7a970ce7d3eba4ab8bf24244a099","observation_id":"fc2dd269-c795-434b-9f86-1ef38063eb39","resolution":{"observed_at":"2026-08-01T11:34:35.933912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:36.036970Z","title":"PPTA gent: Generating and Evaluating Presentations Beyond Text-to-Slides","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:36.036970Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:2a7a86e252ee8b299ff9af9874cfeeb764a9ae4a1c530262e6616d5d0f90c163","observation_id":"7e5729cf-02ab-4b4e-b0b6-759caab52095","resolution":{"observed_at":"2026-08-01T11:34:36.036970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:36.178719Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:36.178719Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:004f593454d3012191672848605dd655c1d9101d54c43dcdfeb1d23ab11d2927","observation_id":"21d5dce1-76d8-4e9b-840b-d230fb668203","resolution":{"observed_at":"2026-08-01T11:34:36.178719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:36.356933Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:36.356933Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:11b26ca23392671ff2590243e7cbff9b00bc1f2e3547d8a687c0def871e675d9","observation_id":"bedc443b-6062-40dd-a716-a6550732e942","resolution":{"observed_at":"2026-08-01T11:34:36.356933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:36.486614Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:36.486614Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:06408a006753369ad4924d335d620afaae0ba386ecca38dbf92967e59fd1d331","observation_id":"7b5236c5-b361-4d88-b8e7-7aad92d029ec","resolution":{"observed_at":"2026-08-01T11:34:36.486614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:36.679196Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:36.679196Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:81ee8172f6faff163c2c401c6752131f7d9029600e30434da43c3cd0f43e8518","observation_id":"52c13b79-f142-46f7-9836-e03cf4761682","resolution":{"observed_at":"2026-08-01T11:34:36.679196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:36.802132Z","title":"AgentBench: Evaluating LLMs as Agents , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:36.802132Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:f495a75adf527b3ea4bf25b36a18ca6b7fdf63453d849d5041e5d20e1252d951","observation_id":"36b84e2a-75f9-4fe8-9136-c6c064c7e38b","resolution":{"observed_at":"2026-08-01T11:34:36.802132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:36.911303Z","title":"GAIA: a benchmark for General AI Assistants , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:36.911303Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:ccbc4a062f64e31e69bd10a04c109be5f66189d64977670655168a26192b37f1","observation_id":"9ceebf64-faf4-4060-8645-40325ee24b61","resolution":{"observed_at":"2026-08-01T11:34:36.911303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:37.009624Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:37.009624Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:5c65eb3795566ef70ffd99cad860503e2f2dc56083f9e5c3bb05fecfda32fb55","observation_id":"033b4e1b-483c-45b8-86e3-345307e2defb","resolution":{"observed_at":"2026-08-01T11:34:37.009624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:37.186390Z","title":"Unveiling Privacy Risks in LLM Agent Memory","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:37.186390Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:a6fc41806455c6d14c75a687f5eb5e22c89bb016f06e3f3a0681342a8f11f0cb","observation_id":"d0e9193e-1632-47cf-ad1a-5e8d2e839726","resolution":{"observed_at":"2026-08-01T11:34:37.186390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:37.327470Z","title":"ACM Trans","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:37.327470Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:42091514f341b49effe8256660600745b86b34bdd3fec758c9e12c25c02dc183","observation_id":"c55f3651-3785-4194-a9be-f996455f9f9d","resolution":{"observed_at":"2026-08-01T11:34:37.327470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:37.501873Z","title":"Proceedings of the Thirty-Third International Joint Conference on Artificial Intelligence,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:37.501873Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:edf1a22ebeb7371bcec729b32f37028e05006578510b77b6d89a7afbb052eb90","observation_id":"faa761ec-2e86-41b5-ad81-3947d7fc3216","resolution":{"observed_at":"2026-08-01T11:34:37.501873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:37.621177Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:37.621177Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:f569d3e1f5039b73dbf865f3f680d03b0488edf34026182863030d87659156be","observation_id":"2eb87ee6-9eea-4fb8-bb04-79b5e225783f","resolution":{"observed_at":"2026-08-01T11:34:37.621177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:37.729368Z","title":"V isual W eb A rena: Evaluating Multimodal Agents on Realistic Visual Web Tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:37.729368Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:a4d905769452b00768b0f4020fe302007a841c015e0682292b136f00a024b916","observation_id":"82de3fd0-22c4-4c2d-9eff-871bd5346e00","resolution":{"observed_at":"2026-08-01T11:34:37.729368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:37.874405Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:37.874405Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:6e19061ccec23a946dafc6e69c4f620e7b84af7ea4bf6b81c9d2b7987b2fcd6c","observation_id":"4c97b9c1-8e39-4c63-954a-a1716f6ca4fa","resolution":{"observed_at":"2026-08-01T11:34:37.874405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:37.986207Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:37.986207Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:f9a4fa6eed029a01ec8b650c33a9cf33a30383e9523af5ae367f592054db576d","observation_id":"48e811af-9073-407a-95fe-fce6b7c6fb77","resolution":{"observed_at":"2026-08-01T11:34:37.986207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.102001Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.102001Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:abbc483a88b43f74a72ad3aabef46662e758500b21a80cbbbed06503c7ad152a","observation_id":"47c14eab-d7c1-411e-98e7-cad199fb6f4b","resolution":{"observed_at":"2026-08-01T11:34:38.102001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.210094Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.210094Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:00efcd7fc9e05b4c975a7adf2f2845e250d51ce6f0255ea93ca87beab3faf113","observation_id":"337352f4-9342-4a87-9498-85fe1c04d9aa","resolution":{"observed_at":"2026-08-01T11:34:38.210094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.324364Z","title":"A pp W orld: A Controllable World of Apps and People for Benchmarking Interactive Coding Agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.324364Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:f371a31236a21a7c6cf6f5793e59cbb7a08bde601d00adb10176c20ba383c9ba","observation_id":"fdabe401-7d72-4717-8874-c3b153abaaf3","resolution":{"observed_at":"2026-08-01T11:34:38.324364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.432195Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.432195Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:00f7e0b03e20fcb95f15bdf30888cb89abf5e82e889f588c9180b546d26aef7b","observation_id":"6b1fbb8a-a117-4302-b04c-53b3d90256e0","resolution":{"observed_at":"2026-08-01T11:34:38.432195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.486753Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.486753Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:57ca77e83ea420b6872b7f117a7f271fa65c074ef46eae25923be39e0436f67d","observation_id":"65ff034f-4848-4889-89a8-3f73ae543420","resolution":{"observed_at":"2026-08-01T11:34:38.486753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.541663Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.541663Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:8365a7f143a0ab4906709ba6b70f8be3b3824ee1e9c0ea5d35b17997205d32aa","observation_id":"75ccf400-6bf2-4b7b-8456-5f33c3ba3ed1","resolution":{"observed_at":"2026-08-01T11:34:38.541663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.601492Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.601492Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:a2695bc2584bd41f7efd38fd441612fa9dcb30c73a9d05360f1c5fd116635077","observation_id":"268a2e7b-3010-40a1-952b-61bb58615b3e","resolution":{"observed_at":"2026-08-01T11:34:38.601492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.653423Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.653423Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:e5e618a4c7781c3e0aaa6cd3fe9f2a4ffa2e7d0b3aa5618c99586e2f2ffc231e","observation_id":"11504068-a8f8-419d-bf95-21d669e82c57","resolution":{"observed_at":"2026-08-01T11:34:38.653423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.731361Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.731361Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:a772f1ac460541ae5d5532204523a668d8a1b64e11f67ae62e2cdd45ce0c4d59","observation_id":"36c437ce-4c40-44db-864b-38f166067a0c","resolution":{"observed_at":"2026-08-01T11:34:38.731361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.796232Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.796232Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:60c56c1070e5e608526b2cc016c2e0b478a04343ec782ff76dda1a8a5cd619bf","observation_id":"18681aec-cfe2-4ec0-9a36-98349b88c736","resolution":{"observed_at":"2026-08-01T11:34:38.796232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:38.861768Z","title":"Proceedings of the ACM SIGOPS 29th Symposium on Operating Systems Principles , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:38.861768Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:eb4f65b56024dcfe13f8c28a46fef0643e1765ec25f60380015d835718419d31","observation_id":"51555dac-be23-4955-9383-9e52cdedd10a","resolution":{"observed_at":"2026-08-01T11:34:38.861768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:39.032412Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:39.032412Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:8a87c33d195d7fd78f8896d6c512e3babcebfe70f4a6068a33081150acebb6d2","observation_id":"f8334092-3b02-45a9-961a-a280a6bf0131","resolution":{"observed_at":"2026-08-01T11:34:39.032412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:39.235075Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:39.235075Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:ff9df9548a98add26bac2a6c5017b041c7449ce708055dc646834c3a52625c1c","observation_id":"a3daeac4-2a8e-490f-87ce-8980629a5ec5","resolution":{"observed_at":"2026-08-01T11:34:39.235075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:39.404500Z","title":"Document Recognition and Retrieval X , editor =","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:39.404500Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:f550f3cfee3f287de0b9c9fe001ff4c797f643392f6989b9c0ea090718cd20cb","observation_id":"cd9b14bf-ad84-4625-ad47-f681dc6b5a2c","resolution":{"observed_at":"2026-08-01T11:34:39.404500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:39.586907Z","title":"Task complexity: A review and conceptualization framework , journal =","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:39.586907Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:8020bec7637261cab01b7563bae9180f4acee7143189824a817b3a41795e06f6","observation_id":"91992db5-8437-4c7c-9983-3abf5392c82c","resolution":{"observed_at":"2026-08-01T11:34:39.586907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.apergo.2005.06.003","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Stanton , abstract =","venue":"Applied Ergonomics","work_id":"c021ddc7-7a51-4fb8-888a-565d1ade5c3c","year":2006},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:39.749997Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:9a968bc747fb0a8b4c351dc98f22b207b0785bbb43350a911bac5408095cf45d","observation_id":"1f72f1f2-927b-41da-9103-fe95078112b9","resolution":{"observed_at":"2026-08-01T11:38:33.967443Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:39.928898Z","title":"2025 , howpublished =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:39.928898Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:f2fe1c7eb1fdc81c48b2bd43422d554ff3ed340cdf569a16f7f0d886a6534176","observation_id":"bfe3a503-9900-4b28-a247-a060e2b8bfb3","resolution":{"observed_at":"2026-08-01T11:34:39.928898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:40.052962Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:40.052962Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:abcca4b17d0fd91a8b151681af9465b00dda17e517d36dead399ec284cb7e9ba","observation_id":"0b8ad28b-4a8b-4873-b64b-8e0f054a155d","resolution":{"observed_at":"2026-08-01T11:34:40.052962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:40.246385Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:40.246385Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:b53574bfdcb1ebbbe386b399681c6827d1cbe7528ef47c7f6fea79fd2af0e702","observation_id":"6c2864f8-4b70-42a9-a178-0b6794dbeb73","resolution":{"observed_at":"2026-08-01T11:34:40.246385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:40.387622Z","title":"and Verme, Manuel Del and Marty, Tom and Vazquez, David and Chapados, Nicolas and Lacoste, Alexandre , title =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:40.387622Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:0fb4f2e352c8b0df57dc837650a3942a5562c05513ab36141a456d3874e56478","observation_id":"1257cc33-8fbc-4b8d-91a1-aaa959ff9967","resolution":{"observed_at":"2026-08-01T11:34:40.387622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:40.504022Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:40.504022Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:13d85d214afe915ca853ce6f6f624035809cb648dfa44de538ceceaeadb610af","observation_id":"c9c9c4f1-063c-41de-adc5-65c063cd8d7a","resolution":{"observed_at":"2026-08-01T11:34:40.504022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:40.620759Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:40.620759Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:c839a973da15ca948ef14d05518ffc479564cae1b75bb0ac3773c2ec73d2f922","observation_id":"28343077-0515-4287-b34d-7d1333a49ffd","resolution":{"observed_at":"2026-08-01T11:34:40.620759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:40.839517Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:40.839517Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:cdd474330f9b93002fff60f184e4857f1c8c4efb3fcc77ba85fd4e67bdb44733","observation_id":"a6043fa1-1394-4769-9f06-ed1ca9837328","resolution":{"observed_at":"2026-08-01T11:34:40.839517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:40.966590Z","title":"API -Bank: A Comprehensive Benchmark for Tool-Augmented LLM s","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:40.966590Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:3f1c413a6c7a81e286fe6db02fce6d7296f015ce81f56fd311c752ee9fe6cc8d","observation_id":"8d143a56-adbe-4263-b98c-ea6cf331353d","resolution":{"observed_at":"2026-08-01T11:34:40.966590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:41.144273Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:41.144273Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:7ce9af04241ae31d86b090976c26cf3b900577dd9f7b83b8eb4b010c49c760e1","observation_id":"eb54936e-96ee-4661-ba1f-284f35c27276","resolution":{"observed_at":"2026-08-01T11:34:41.144273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:41.230764Z","title":"A survey on large language model based autonomous agents , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:41.230764Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:57e3440c158b3a7e80e224601af6097d7448ed3dd2ae4953fec556cd279c9f35","observation_id":"b994f9d0-a42b-42dc-b142-5ee544bca684","resolution":{"observed_at":"2026-08-01T11:34:41.230764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:34:41.352899Z","title":"Document Understanding Dataset and Evaluation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T11:34:41.352899Z"},"links":{"citing_paper":"/paper/2607.19865"},"observation_digest":"sha256:4f90f7e4383d654d89b45ab418693f61e90cb9dd59d4ee701cf56bf8ae3baf79","observation_id":"7cbbf81e-e158-4084-a76d-0259f72e606c","resolution":{"observed_at":"2026-08-01T11:34:41.352899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19865","last_updated":"2026-07-22T07:52:59Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T08:18:31.217879Z","submitted_at":"2026-07-22T07:52:59Z","title":"DocOps: A Verifiable Benchmark for Autonomous Agents in Complex Document Operations"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 1 inbound Pith citation observation for arXiv:2607.19865."}