{"as_of":"2026-08-05T23:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5c45dc7be85cc2fbd256e590d7319a120cf07f8c7c70d94142144db26ad62867","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T03:38:17.347721Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2501.16150","last_updated":"2026-03-27T07:41:10Z","snapshot_observed_at":"2026-08-02T22:37:46.736145Z","submitted_at":"2025-01-27T15:44:02Z","title":"A Comprehensive Survey of Agents for Computer Use: Foundations, Challenges, and Future Directions","version":3},"reference_index":163,"source":"pdf_text","source_observed_at":"2026-05-23T04:59:36.994758Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2501.16150"},"observation_digest":"sha256:abd1816ec484937e2c2439e7249908b06caec620c307872cb83105959431ca1f","observation_id":"c58cb6eb-8d61-4432-b146-05acd5fc2ac8","resolution":{"observed_at":"2026-05-23T05:02:35.183609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2512.13168","last_updated":"2026-04-15T17:46:00Z","snapshot_observed_at":"2026-07-31T12:41:54.136440Z","submitted_at":"2025-12-15T10:28:45Z","title":"Finch: Benchmarking Finance & Accounting across Spreadsheet-Centric Enterprise Workflows","version":5},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-16T22:43:48.618334Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2512.13168"},"observation_digest":"sha256:aa70b5ce931e025921a9cffb3c8f059ea2ab168410788f1effd3bdd9442cb0ab","observation_id":"190d4e78-2aa6-45b2-b793-a914e9469cc3","resolution":{"observed_at":"2026-05-16T22:48:38.345661Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2604.05172","last_updated":"2026-04-08T09:27:21Z","snapshot_observed_at":"2026-07-06T22:54:00.211106Z","submitted_at":"2026-04-06T21:09:06Z","title":"ClawsBench: Evaluating Capability and Safety of LLM Productivity Agents in Simulated Workspaces","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:47:11.883682Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2604.05172"},"observation_digest":"sha256:4cbf4a6a0d2fd50d70b48c6d8b222ec01eb958f2547cec914ebfc95edde060bb","observation_id":"c6641c63-42b8-4ca7-94be-ee4dc21fd541","resolution":{"observed_at":"2026-05-10T23:55:51.736435Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2605.02729","last_updated":"2026-05-04T15:28:59Z","snapshot_observed_at":"2026-07-06T23:15:46.390406Z","submitted_at":"2026-05-04T15:28:59Z","title":"Augmenting Interface Usability Heuristics for Reliable Computer-Use Agents","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T18:52:16.162336Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2605.02729"},"observation_digest":"sha256:fe7cd9672f9df7df4f951592f808ba3582e9dacb3e089303c4a7676ea9d54194","observation_id":"eceda6fe-72ac-4586-9f37-1665576155b5","resolution":{"observed_at":"2026-05-09T06:10:36.935279Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2605.10384","last_updated":"2026-05-11T11:24:20Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T11:24:20Z","title":"Agentic Performance at the Edge: Insights from Benchmarking","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-12T05:22:39.323345Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2605.10384"},"observation_digest":"sha256:b77f294a269926d4a8e5ae65c63b5fbaa35c1d91ef70645650e65e19fab083ef","observation_id":"2193da31-5f56-4a81-8702-da43c9d03f2c","resolution":{"observed_at":"2026-05-12T05:26:25.051461Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2605.13880","last_updated":"2026-05-11T04:34:43Z","snapshot_observed_at":"2026-07-06T23:25:25.361350Z","submitted_at":"2026-05-11T04:34:43Z","title":"PREPING: Building Agent Memory without Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T06:14:14.385586Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2605.13880"},"observation_digest":"sha256:e0c3cc263b3bc6ad82acca54a36c15e000eb4c2de040055e55382667d9caafaa","observation_id":"013aa40d-19f6-45a2-91d6-66f5db277ad9","resolution":{"observed_at":"2026-05-15T06:15:06.136812Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2605.30907","last_updated":"2026-05-29T06:43:23Z","snapshot_observed_at":"2026-07-06T23:40:07.833692Z","submitted_at":"2026-05-29T06:43:23Z","title":"BlueFin: Benchmarking LLM Agents on Financial Spreadsheets","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T21:35:45.197423Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2605.30907"},"observation_digest":"sha256:9346908da8738830a6eec79a5ee395db9430da985616bc852ad4f0ce5c269450","observation_id":"6b947164-96fc-4a0e-a60e-1ac774deaf1d","resolution":{"observed_at":"2026-07-01T20:06:12.357210Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2606.06708","last_updated":"2026-06-04T20:48:37Z","snapshot_observed_at":"2026-08-05T14:41:57.048215Z","submitted_at":"2026-06-04T20:48:37Z","title":"Signal-Driven Observation for Long-Horizon Web Agents","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-28T01:25:11.149977Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2606.06708"},"observation_digest":"sha256:963808291d37fa02a1b58429f6b972d41ef052863e0f35737c5114c3c22b2dc8","observation_id":"4b235737-0405-4a4c-a78e-2228eec695fd","resolution":{"observed_at":"2026-06-28T01:31:29.229037Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2606.28480","last_updated":"2026-06-26T17:59:51Z","snapshot_observed_at":"2026-07-07T00:02:33.644076Z","submitted_at":"2026-06-26T17:59:51Z","title":"TUA-Bench: A Benchmark for General-Purpose Terminal-Use Agents","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-06-30T01:19:54.081755Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2606.28480"},"observation_digest":"sha256:7007d51d76630845cd1dc88709556b8a8b730511fb6d0f45a6a2e174aa12189b","observation_id":"3518003a-bc10-4f58-b364-081854468251","resolution":{"observed_at":"2026-07-01T15:35:48.605245Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2606.29537","last_updated":"2026-07-13T10:30:17Z","snapshot_observed_at":"2026-07-17T23:18:06.822637Z","submitted_at":"2026-06-28T17:59:17Z","title":"OSWorld 2.0: Benchmarking Computer Use Agents on Long-Horizon Real-World Tasks","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-30T07:10:38.909339Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2606.29537"},"observation_digest":"sha256:78c28a8833bfc47f93d74380647d6c81804eefd103d917644f9a4f571e6d231c","observation_id":"0dd78781-e5e2-428c-b398-8a4df4fabe55","resolution":{"observed_at":"2026-06-30T07:14:21.123636Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-07-15T10:24:53.345620Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.29537","last_updated":"2026-07-13T10:30:17Z","snapshot_observed_at":"2026-07-17T23:18:06.822637Z","submitted_at":"2026-06-28T17:59:17Z","title":"OSWorld 2.0: Benchmarking Computer Use Agents on Long-Horizon Real-World Tasks","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-15T10:24:53.345620Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2606.29537"},"observation_digest":"sha256:164441be117eefd7b77feab35afa816fef0560e2cd94fe63310965894b37eb82","observation_id":"4943d705-0fc6-4132-9ee3-cdf48f480e6d","resolution":{"observed_at":"2026-07-15T10:24:53.345620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2607.06008","last_updated":"2026-07-09T11:01:43Z","snapshot_observed_at":"2026-07-12T23:17:38.931960Z","submitted_at":"2026-07-07T08:50:09Z","title":"PolyWorkBench: Benchmarking Multilingual Long-Horizon LLM Agents","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-08T20:03:47.212663Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2607.06008"},"observation_digest":"sha256:22a2c93f3b2a34efcbfc4ac50ab7dd2986dcf85058b80e3e3aa0ef6add3cd027","observation_id":"d4f85837-c667-493b-bddf-ea639727d18b","resolution":{"observed_at":"2026-07-08T20:05:34.099480Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":"2407.19056","doi":"10.48550/arxiv.2407.19056","metadata_source":"pith","pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Officebench: Benchmarking language agents across multiple applications for office automation","venue":"cs.CL","work_id":"1f4b598a-160f-4513-9b90-2233578e53a0","year":2024},"citing_paper":{"arxiv_id":"2607.06008","last_updated":"2026-07-09T11:01:43Z","snapshot_observed_at":"2026-07-12T23:17:38.931960Z","submitted_at":"2026-07-07T08:50:09Z","title":"PolyWorkBench: Benchmarking Multilingual Long-Horizon LLM Agents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T01:37:23.646537Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2607.06008"},"observation_digest":"sha256:9f08f054b758be196f3992f252be914b03191e285fae8d313f90185e9d5bb899","observation_id":"ac55d9ce-f3a7-4083-b841-78885a022dff","resolution":{"observed_at":"2026-07-11T01:37:42.726491Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-08-01T03:38:17.347721Z","title":"OfficeBench: Benchmarking language agents across multiple applications for office automation.arXiv preprint arXiv:2407.19056, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23124","last_updated":"2026-07-25T09:58:24Z","snapshot_observed_at":"2026-08-01T21:13:06.083655Z","submitted_at":"2026-07-25T09:58:24Z","title":"AgentOmnia: Scaling Agentic Models for Full-Scenario Applications","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T03:38:17.347721Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2607.23124"},"observation_digest":"sha256:180577550108f79cd8b5ff7de604c7a21a812ec1a0e3a4bc721ac06ce6001e30","observation_id":"afff5545-726f-45fd-b48d-709ba2dcfc7c","resolution":{"observed_at":"2026-08-01T03:38:17.347721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19056","snapshot_observed_at":"2026-07-30T10:50:09.743229Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.27155","last_updated":"2026-07-29T17:33:47Z","snapshot_observed_at":"2026-08-03T10:37:01.473880Z","submitted_at":"2026-07-29T17:33:47Z","title":"OmegaUse-OfficeVal: Benchmarking LLM Agents on Long-Horizon Office-Suite Tasks with Economic Grounding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-30T10:50:09.743229Z"},"links":{"cited_paper":"/paper/2407.19056","citing_paper":"/paper/2607.27155"},"observation_digest":"sha256:8f6cae08073915a6dcc844b4975aba2be593b1ba52aa0d6c20b8f6f71ca181c5","observation_id":"d5a4e0de-8ef9-4a4f-a39a-c9280cd26447","resolution":{"observed_at":"2026-07-30T10:50:09.743229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.19056/citation-record","integrity":"/paper/2407.19056/integrity","json":"/paper/2407.19056/citation-record.json","paper":"/paper/2407.19056"},"outbound":[],"paper":{"arxiv_id":"2407.19056","last_updated":"2024-07-26T19:27:17Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-03T10:35:13.470915Z","submitted_at":"2024-07-26T19:27:17Z","title":"OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2407.19056."}