{"as_of":"2026-08-07T16:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:472620a46d75e6b3b8797db8ee3bac8989c2fac9545eeefc2dee5284c8bd7d33","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T01:39:57.741032Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T19:49:39.606312Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.08768","snapshot_observed_at":"2026-07-31T19:49:39.606312Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28037","last_updated":"2026-07-30T11:18:47Z","snapshot_observed_at":"2026-08-06T18:49:50.303633Z","submitted_at":"2026-07-30T11:18:47Z","title":"ClawTrack: Towards Trace-Level Evaluation and Improvement of Real-World Autonomous Agents","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T19:49:39.606312Z"},"links":{"cited_paper":"/paper/2607.08768","citing_paper":"/paper/2607.28037"},"observation_digest":"sha256:10c0b1114428aa102519454fca70c43202cc36d1b06664e1ee3715ab69d6e526","observation_id":"c8a93242-5160-4e9b-bfba-30b4a47d5fe7","resolution":{"observed_at":"2026-07-31T19:49:39.606312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.08768/citation-record","integrity":"/paper/2607.08768/integrity","json":"/paper/2607.08768/citation-record.json","paper":"/paper/2607.08768"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.509985Z","title":"Pinchbench: Real-world benchmarks for ai coding agents","venue":null,"work_id":"4ece4811-0d7d-4b10-a5ba-30c642d8f5ef","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:02139949f3e948d3cc7bfc1a8a1eea9fc632ba1ff9a76501371e8d77e9bb124c","observation_id":"6c75db65-7fa2-475a-abdf-7006fb8313d4","resolution":{"observed_at":"2026-07-10T02:06:42.511408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.506102Z","title":"Kimi k2.6: From code to creation, from one to many","venue":null,"work_id":"0abc02ea-a7fc-4ade-8b69-b0c9fc11d439","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:9838916e2dce91364d7c5a34a9160ef050ae7a0178588da291cccfa63e646922","observation_id":"5e5f8c88-32f2-4d34-bf13-8d8979a9c982","resolution":{"observed_at":"2026-07-10T02:06:42.507307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.507906Z","title":"Introducing claude opus 4.6","venue":null,"work_id":"00cf96d1-37f3-4a78-971d-4f45f287c4c7","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:3b1e6ee9e86284dbb7c85cac125a075550fd513e3075a5cfb2fa709f5dd2cfd6","observation_id":"0bb5bc2e-f13f-48ac-badb-261131da8509","resolution":{"observed_at":"2026-07-10T02:06:42.508998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.511272Z","title":"Introducing claude sonnet 4.6","venue":null,"work_id":"8b31c7c5-8f5f-44c5-a69c-50d1984c208b","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:c31dbe1fca74a0c333f878c3159820269d0391037487706090870c85cb78ee92","observation_id":"a52ac535-84b3-4e8c-a8a8-66ce8e111aac","resolution":{"observed_at":"2026-07-10T02:06:42.512359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.509575Z","title":"Openclaw web-search skill","venue":null,"work_id":"0fa351b5-4d6e-4d71-ac2f-8f7ddadd18c9","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:33fcbcff7bb8d411d2be7102c1d3d3bdf2eacb0ee3652d55a112ada1bc1b1ffc","observation_id":"c6e42378-8fa1-46d0-8deb-cbb284dd9225","resolution":{"observed_at":"2026-07-10T02:06:42.510676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.524920Z","title":"Openclaw edict.https://github.com/cft0808/edict, 2026","venue":null,"work_id":"0f50263e-4db3-4871-944f-c5dd49b8140d","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:75dad74e901b9a40f7739be92ba60192e9960237078295c46f71a3997e627a48","observation_id":"590bc953-51e7-4ead-8d9c-1a14212dc839","resolution":{"observed_at":"2026-07-10T02:06:42.526187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12588","last_updated":"2023-10-23T01:27:38Z","snapshot_observed_at":"2026-08-02T13:06:11.850456Z","submitted_at":"2022-11-22T21:06:00Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","version":4},"cited_work":{"arxiv_id":"2211.12588","doi":"10.48550/arxiv.2211.12588","metadata_source":"pith","pith_arxiv_id":"2211.12588","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Program of Thoughts Prompting: Disentangling Computation from Reasoning for Numerical Reasoning Tasks","venue":"cs.CL","work_id":"618aa44c-a6c6-425c-abce-8aa8aa842921","year":2022},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2211.12588","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:d99c8699d628bf3cffc6815fdd215ca0294f2d9e0e3bc92ceff44a4e478cb067","observation_id":"3b08ba97-47b8-4841-83d9-bfda3ce3592f","resolution":{"observed_at":"2026-07-10T01:46:41.278763Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05467","last_updated":"2025-02-28T16:02:27Z","snapshot_observed_at":"2026-08-06T15:44:08.375632Z","submitted_at":"2024-12-06T23:43:59Z","title":"The BrowserGym Ecosystem for Web Agent Research","version":4},"cited_work":{"arxiv_id":"2412.05467","doi":"10.48550/arxiv.2412.05467","metadata_source":"pith","pith_arxiv_id":"2412.05467","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Xu, Siva Reddy, Quentin Cappart, Graham Neubig, Ruslan Salakhutdinov, Nicolas Chapados, and Alexandre Lacoste","venue":"cs.LG","work_id":"f7dd22e4-8dc0-4a62-a313-cb0712e5d7dc","year":2024},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2412.05467","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:04a742531deb51ed39009a5249025cef474ca1e3f7919644f32806106f3ba4da","observation_id":"b7abcdf7-07d1-46a9-9376-5fe73ec7d829","resolution":{"observed_at":"2026-07-10T01:46:41.292086Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.536017Z","title":"Duckduckgo search openclaw","venue":null,"work_id":"ebf87fe5-f60f-4a13-8cfe-649cf9de4816","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:edd33fc39d7f6add47fd78d0e64a7221b28489fb3ff3585a77b1ebf07d9cee7f","observation_id":"dbc15a0b-2770-4f50-99bf-26b7e77e8135","resolution":{"observed_at":"2026-07-10T02:06:42.537106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07718","last_updated":"2024-07-23T06:19:28Z","snapshot_observed_at":"2026-08-02T12:09:24.340284Z","submitted_at":"2024-03-12T14:58:45Z","title":"WorkArena: How Capable Are Web Agents at Solving Common Knowledge Work Tasks?","version":5},"cited_work":{"arxiv_id":"2403.07718","doi":"10.48550/arxiv.2403.07718","metadata_source":"pith","pith_arxiv_id":"2403.07718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WorkArena: How Capable Are Web Agents at Solving Common Knowledge Work Tasks?","venue":"cs.LG","work_id":"5ac27d9e-4522-46f8-985e-0e4f73130803","year":2024},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2403.07718","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:95510eedde90703ed6c74dccd3c1acb91d28bd64191547c1125c2f1476ca6026","observation_id":"c12c19bd-84b0-4c53-a253-b9545d878bb7","resolution":{"observed_at":"2026-07-10T01:46:41.276240Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.617914Z","title":"Codeplot-cot: Mathematical visual reasoning by thinking with code-driven images","venue":null,"work_id":"3b91506f-ef15-42d3-835e-385960e59378","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:827b81371b1496be95ef09fd348352be9ff747d90a340ec344455ecfd36ff867","observation_id":"e1cf27cf-a589-4779-baa2-70fd2da715ed","resolution":{"observed_at":"2026-07-10T02:06:42.619052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.599107Z","title":"Gemini 3 flash.https://deepmind.google/models/gemini/flash/, 2025","venue":null,"work_id":"963fec8b-bb36-46c7-a36b-fe857953e87f","year":2025},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:17f8f8c1b1def369ecff8fcbc5660e10fa0581cceaacee4496322c07f6b8f06b","observation_id":"a8f243cf-6b9e-4b5d-a013-d4545731e5d2","resolution":{"observed_at":"2026-07-10T02:06:42.600321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.585899Z","title":"Gemini 3.1 flash lite.https://deepmind.google/models/gemini/flash-lite/, 2026","venue":null,"work_id":"73a6045e-b708-488e-bfa9-ce57ad2df6c8","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:b8cf83ca49f9d7850e10ad4e3bc3f7f8105cb568a2fbe96bacd2f30bde6891f8","observation_id":"3875fa8b-1d8e-4f31-b1e1-7ad060fb0da2","resolution":{"observed_at":"2026-07-10T02:06:42.587147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.593724Z","title":"Gemini 3.1 pro.https://deepmind.google/models/gemini/pro/, 2026","venue":null,"work_id":"237d4aaa-d24c-4a8a-9997-b86171a25775","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:090c5b821e0701ab6dc2a7dfe352bc580de0936b28f9a2fefa8b7acd6ef4e819","observation_id":"777fafe2-86a2-4a9d-9360-851717c64472","resolution":{"observed_at":"2026-07-10T02:06:42.594892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.600895Z","title":"Cogagent: A visual language model for gui agents","venue":null,"work_id":"60e5f890-7ad5-4afd-8582-0a3cdeb2c162","year":2024},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:2c7caa60fb6393082fc10ff78ad67c960dfec436cd4b9d5b5490f434cb155be2","observation_id":"3140aba7-6b33-454b-a273-775ddead7673","resolution":{"observed_at":"2026-07-10T02:06:42.602275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.591399Z","title":"Macagentbench: Benchmark agents where they actually work — on macos","venue":null,"work_id":"99137de2-5474-419d-bfb0-2191091c10e7","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:1401eb1ca6137e40854dc04221bfbf077c8db5a1b9b244bb99b57b32f62008cf","observation_id":"9f4a6df9-a7da-477a-8229-8f46438296ae","resolution":{"observed_at":"2026-07-10T02:06:42.592673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.603150Z","title":"Visualwebarena: Evaluating multimodal agents on realistic visual web tasks","venue":null,"work_id":"08fbcbb6-730e-4eab-a099-11c97048551a","year":2024},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:758ad44c8b420ac84a9e44239b5b7ff1ce717c6a8990af49b80cc198e5e16335","observation_id":"32f20998-78e7-4833-be58-7e4c0726c600","resolution":{"observed_at":"2026-07-10T02:06:42.604342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.621926Z","title":"Agent browser openclaw","venue":null,"work_id":"ace36142-a6c2-457a-a1f8-86049fca5280","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:64e943d07bd7d0ec6f5120bd3e2bdbbd8f59e45b5e63c17ba58acbc95906d9d2","observation_id":"8ec9c0f7-193f-464d-a93b-adc3a35dabcf","resolution":{"observed_at":"2026-07-10T02:06:42.623013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12670","last_updated":"2026-03-13T07:33:01Z","snapshot_observed_at":"2026-07-06T22:45:44.135338Z","submitted_at":"2026-02-13T07:06:06Z","title":"SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks","version":3},"cited_work":{"arxiv_id":"2602.12670","doi":"10.48550/arxiv.2602.12670","metadata_source":"pith","pith_arxiv_id":"2602.12670","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks","venue":"cs.AI","work_id":"b477d12a-2ca6-4894-9f90-3fb479635e98","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2602.12670","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:a825a26ab517353d83b3310271410e08ef36528541138c9a532397d7051992f2","observation_id":"3d8541db-d079-4165-90d2-abedb1557172","resolution":{"observed_at":"2026-07-10T01:46:41.268069Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-06T20:36:41.418114Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":"2308.03688","doi":"10.1109/fllm63129.2024.10852426","metadata_source":"pith","pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgentBench: Evaluating LLMs as Agents","venue":"cs.AI","work_id":"a37549b4-4c94-412d-acc4-4efeb08509be","year":2023},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:724066d2133a68f1c682faaeadace24d2a3506b1998b9d792ef3f52d6fdc5e14","observation_id":"4060cc8f-298b-47dc-a826-a7fd2f91b190","resolution":{"observed_at":"2026-07-10T01:46:41.265553Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.13072","last_updated":"2026-06-25T07:57:24Z","snapshot_observed_at":"2026-08-07T10:12:53.275765Z","submitted_at":"2026-03-20T16:08:21Z","title":"LiveClawBench: Benchmarking LLM Agents on Complex, Real-World Assistant Tasks","version":2},"cited_work":{"arxiv_id":"2604.13072","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.13072","snapshot_observed_at":"2026-07-10T01:46:41.280088Z","title":"LiveClawBench: Benchmarking LLM Agents on Complex, Real-World Assistant Tasks","venue":"cs.CL","work_id":"10b104ad-6626-42e2-92b8-8ff6f4d02857","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2604.13072","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:d01785b72c8178e15ed80d72422a6db1db8f3aa5cfc6a816134ae56ebee1ca6d","observation_id":"e52b6e80-b94c-45d9-8f6b-2b2fd603de01","resolution":{"observed_at":"2026-07-10T01:46:41.281407Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.554295Z","title":"Agentboard: An analytical evaluation board of multi-turn llm agents.Advances in neural information processing systems, 37:74325–74362","venue":null,"work_id":"d63a8df5-0d2a-4c2d-b1b2-64ae703c9083","year":2024},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:8e1bb175b6ca41fd73a02eb6ead2388f9d9bda183335bef654abe933ac9af58b","observation_id":"f8374b79-244e-4155-b7b0-50598ad4fe97","resolution":{"observed_at":"2026-07-10T02:06:42.555822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08377","last_updated":"2026-04-09T15:38:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-09T15:38:27Z","title":"SkillClaw: Let Skills Evolve Collectively with Agentic Evolver","version":1},"cited_work":{"arxiv_id":"2604.08377","doi":"10.48550/arxiv.2604.08377","metadata_source":"pith","pith_arxiv_id":"2604.08377","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"SkillClaw: Let Skills Evolve Collectively with Agentic Evolver","venue":"cs.AI","work_id":"31a44ebb-9aae-4719-8d62-50f8c82ece16","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2604.08377","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:1079cf450b61386c5b6f3b55e8ab64fee12142a2c2ab115c3301daf49dff5149","observation_id":"5b6b4aeb-a57d-4c56-84ca-395eee9bd5d2","resolution":{"observed_at":"2026-07-10T01:46:41.263069Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.556482Z","title":"Desktop control openclaw","venue":null,"work_id":"1c0f7efe-f0b6-4459-bc5a-cc645d8709b4","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:ec9a25972b365709c9ace289e8528ebdf78788477651c7cffabd64935918039d","observation_id":"6115dd1a-a17d-40f5-8398-9a1a16594027","resolution":{"observed_at":"2026-07-10T02:06:42.557817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"cited_work":{"arxiv_id":"2604.23781","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23781","snapshot_observed_at":"2026-07-11T01:37:42.725645Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","venue":"cs.CV","work_id":"d318932b-5733-4526-a467-d57db0337db5","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2604.23781","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:bde800c1d4269d224c79b9728349aac3270576cf46e4a8be2f9aa237425d885a","observation_id":"eade2889-5875-4bbc-859a-1e97167440ab","resolution":{"observed_at":"2026-07-10T01:46:41.270682Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.560527Z","title":"Gaia: a benchmark for general ai assistants","venue":null,"work_id":"a7341f04-163e-406f-81d5-6ddb1dfd000f","year":2023},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:b484dffa2cf79a4c5c30e1f8e2e54a6e92114147a188fceb94b3d40e7fe1c2e2","observation_id":"31120ae4-d8b3-4418-ac90-c34b1b819fcc","resolution":{"observed_at":"2026-07-10T02:06:42.561797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.564049Z","title":"Hermes agent: An agent that grows with you","venue":null,"work_id":"3a24a7fe-b4fd-44b9-9c0d-b96f1dcbafe3","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:e85348e46a9585462a04980e2a6034212b594191a2ac3ab7af534648d29484b0","observation_id":"132fa747-b504-4874-8b9c-603606db00e1","resolution":{"observed_at":"2026-07-10T02:06:42.565323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.566194Z","title":"Introducing gpt-4.1 in the api.https://openai.com/index/gpt-4-1/","venue":null,"work_id":"8399ba59-2419-4e5e-8475-6a50664e50df","year":2025},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:1abc4c2c36c1dbd223940fe0528287c5633a549433ce858d76aafff8f2be983f","observation_id":"4193270e-6905-4c75-a0af-b7f4ffe03966","resolution":{"observed_at":"2026-07-10T02:06:42.567597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.543592Z","title":"Introducing gpt-5.4","venue":null,"work_id":"89e6f427-209f-4998-9af5-ab1b7dc64ec9","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:b97018bd458218190681cffb8b282d2d32af285b6dde51ee0927b8081c423982","observation_id":"a5034a0b-d1bf-4446-b644-8e1f4e875121","resolution":{"observed_at":"2026-07-10T02:06:42.544799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.568136Z","title":"Introducing gpt-5.4 mini and nano","venue":null,"work_id":"bc3f1fa5-7a64-400f-b875-796e00c722cb","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:7aafaf20d8a106f55173f2f828fac2c91b53e6d83e934d9a130043280731cbe2","observation_id":"23de0ac2-4aff-4a5e-a226-fd52de0e06fd","resolution":{"observed_at":"2026-07-10T02:06:42.569416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09014","last_updated":"2023-03-16T01:04:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-16T01:04:45Z","title":"ART: Automatic multi-step reasoning and tool-use for large language models","version":1},"cited_work":{"arxiv_id":"2303.09014","doi":"10.48550/arxiv.2303.09014","metadata_source":"pith","pith_arxiv_id":"2303.09014","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ART: Automatic multi-step reasoning and tool-use for large language models","venue":"cs.CL","work_id":"0bffef46-48af-4851-abce-a3d6792d044b","year":2023},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2303.09014","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:1b1b1171011790b923c9b414fee7c29aac5e12e78f6b58c83eece6313fc5fc6d","observation_id":"69b72fb5-e2e9-4bf1-a579-f580c9b95296","resolution":{"observed_at":"2026-07-10T01:46:41.281240Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12255","last_updated":"2022-05-24T17:58:13Z","snapshot_observed_at":"2026-08-07T07:09:50.694532Z","submitted_at":"2022-05-24T17:58:13Z","title":"TALM: Tool Augmented Language Models","version":1},"cited_work":{"arxiv_id":"2205.12255","doi":"10.48550/arxiv.2205.12255","metadata_source":"pith","pith_arxiv_id":"2205.12255","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Talm: Tool augmente d language models","venue":"cs.CL","work_id":"1ef8ca63-43d3-4f57-8da5-c4433529d3f6","year":2022},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2205.12255","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:5c18687440b544bd23da9efb345f1934b9923d4d5482310a8c5b3faa4e15a667","observation_id":"dd6d8b69-96d9-4fe2-a4b4-aa2cb8575943","resolution":{"observed_at":"2026-07-10T01:46:41.283601Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16789","last_updated":"2023-10-03T14:45:48Z","snapshot_observed_at":"2026-07-06T16:00:46.542753Z","submitted_at":"2023-07-31T15:56:53Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","version":2},"cited_work":{"arxiv_id":"2307.16789","doi":"10.48550/arxiv.2307.16789","metadata_source":"pith","pith_arxiv_id":"2307.16789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","venue":"cs.AI","work_id":"3c555b48-a4d9-42dd-9fdd-0f6018fbe9cb","year":2023},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2307.16789","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:fab5065f0472fcbcfa72766755f7f7cf765581f32c78560c3b307e0edd1c1eca","observation_id":"3a4f3bda-f0cc-45dc-95c4-7eac4e18ffee","resolution":{"observed_at":"2026-07-10T01:46:41.289461Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-12T03:19:33.730697+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T03:19:33.730697+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14573","last_updated":"2025-04-06T20:37:50Z","snapshot_observed_at":"2026-08-07T08:11:20.950548Z","submitted_at":"2024-05-23T13:48:54Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","version":5},"cited_work":{"arxiv_id":"2405.14573","doi":"10.48550/arxiv.2405.14573","metadata_source":"pith","pith_arxiv_id":"2405.14573","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents","venue":"cs.AI","work_id":"c5116d19-d3d3-40fd-9620-f7489812a9ba","year":2024},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2405.14573","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:d3c168ae910cf39a7029af555b36cb699a3ad8a3209dd6a41931ee32de9c675a","observation_id":"8ccae9c2-8b01-43d7-a3d7-40e38bb3e834","resolution":{"observed_at":"2026-07-10T01:46:41.308819Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.610144Z","title":"Nanobot: The ultra-lightweight personal ai agent","venue":null,"work_id":"a98a66b6-b186-4385-ac24-addabc772076","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:3bb195827eda63d79ffb03331fcf3ebf28141a8589a891497abe940f2438b154","observation_id":"e109df51-6418-4e54-8095-0d69f4a7e2e6","resolution":{"observed_at":"2026-07-10T02:06:42.611383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.615980Z","title":"Toolformer: Language models can teach themselves to use tools.Advances in neural information processing systems, 36: 68539–68551","venue":null,"work_id":"b18d1b4f-f40e-4afe-aaf9-d74b9349d25e","year":2023},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:2d0499d95e0f5183dd4bb33efaa39909c7efdf3b07b67a346152140d010ee580","observation_id":"e8e7db00-0875-4da1-82c5-07b1c3513ca1","resolution":{"observed_at":"2026-07-10T02:06:42.617293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.619961Z","title":"Hugginggpt: Solving ai tasks with chatgpt and its friends in hugging face.Advances in Neural Information Processing Systems, 36:38154–38180","venue":null,"work_id":"3f725327-f836-4c9d-a50c-19ffa60c022f","year":2023},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:22d08fbbfd90682ef612a58f9a7caf8db5bb9b813494d67220e4ea7a6a055ceb","observation_id":"9ba879b3-5ff9-4824-b6c0-06a13a1cf769","resolution":{"observed_at":"2026-07-10T02:06:42.621345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.611981Z","title":"Reflexion: Language agents with verbal reinforcement learning.Advances in neural information processing systems, 36:8634–8652","venue":null,"work_id":"a7867616-b761-49f9-87e2-c36aa3664b6f","year":2023},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:64adf36bc5f8d81a0c9684f658af2ea5324e7ec2273be2baf8840e7715631453","observation_id":"7b5a12df-b1db-42bc-ab4f-d375e240e020","resolution":{"observed_at":"2026-07-10T02:06:42.613328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.593361Z","title":"Openclaw.https://github.com/openclaw/openclaw, 2025","venue":null,"work_id":"5b0cf1c7-bcc3-49fc-8d4d-6083481b704d","year":2025},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:e3d3c654dc961eb3bae1b27076ad51385f32854ed8f6ccf5b8726ab8432701bd","observation_id":"a44b9f56-5c29-48a3-8905-d17cd65ad30b","resolution":{"observed_at":"2026-07-10T02:06:42.594604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15804","last_updated":"2026-04-21T03:35:14Z","snapshot_observed_at":"2026-08-01T22:56:50.755050Z","submitted_at":"2026-04-17T08:05:46Z","title":"Qwen3.5-Omni Technical Report","version":2},"cited_work":{"arxiv_id":"2604.15804","doi":"10.48550/arxiv.2604.15804","metadata_source":"pith","pith_arxiv_id":"2604.15804","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Qwen3.5-Omni Technical Report","venue":"cs.CL","work_id":"9d0aeac4-3b94-4a09-af62-5e32286fdf5f","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2604.15804","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:78981128faa93524300aea1aa9060007e613a02499300e5fcb5d7e2bf825e80e","observation_id":"f146a63c-e274-41f0-aff1-c9df45192dc2","resolution":{"observed_at":"2026-07-10T01:46:41.297163Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.08412","doi":"10.48550/arxiv.2602.08412","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From assistant to double agent: Formalizing and benchmarking attacks on OpenClaw for personalized local AI agent","venue":"Open MIND","work_id":"c1f5d74f-3091-4e88-9f5b-577d17e1124e","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:f263a37ad6db9d00406aee79ec570628164b49132ffa991001e38d57f88ba226","observation_id":"6f8d1d88-c712-495a-a00a-445ecbe775db","resolution":{"observed_at":"2026-07-10T01:46:41.300025Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.595164Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"a3ac3b4d-8c58-4772-ad55-18e8fb162bd1","year":2022},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:d671830b5f2b2dad01cd3b42c2d1ac483b5b4fe0dd940aadbec53410ede8007e","observation_id":"101dd469-3a5c-4952-847f-bd48e84aac94","resolution":{"observed_at":"2026-07-10T02:06:42.596364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.597290Z","title":"Intelligent agents: Theory and practice.The knowledge engineering review, 10(2):115–152","venue":null,"work_id":"7a72adc7-2e08-42aa-8d6e-6e03597e18b0","year":1995},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:eb5e40f61db774bb43b6d1553591a8f607eb77c8c6ae74eb8456ccd87aac0023","observation_id":"44eeddb9-e227-4cf0-9c73-55cd0b02d98c","resolution":{"observed_at":"2026-07-10T02:06:42.598482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.17187","doi":"10.48550/arxiv.2603.17187","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Metaclaw: Just talk–an agent that meta-learns and evolves in the wild","venue":"arXiv (Cornell University)","work_id":"118635c4-eee7-48da-9dfe-ffaf07704aa7","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:81987592bcdc342f923da3e6d7c2674d99864fe5d100633f0c4686ff160c1f51","observation_id":"c2004007-2095-4485-bf92-bcd7a853cbdf","resolution":{"observed_at":"2026-07-10T01:46:41.289460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.601003Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments.Advances in Neural Information Processing Systems, 37:52040–52094","venue":null,"work_id":"56792ea8-ed96-4503-89ff-a4fd69b3f98b","year":2024},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:834081b979c8f8ee61c4cb8176bed79a67b2f796833de1e1e8890fc7430b67aa","observation_id":"eb67096b-0957-4e38-acbb-839d0b40cb49","resolution":{"observed_at":"2026-07-10T02:06:42.602498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14161","last_updated":"2025-09-10T08:35:19Z","snapshot_observed_at":"2026-08-01T16:27:28.241667Z","submitted_at":"2024-12-18T18:55:40Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","version":3},"cited_work":{"arxiv_id":"2412.14161","doi":"10.48550/arxiv.2412.14161","metadata_source":"pith","pith_arxiv_id":"2412.14161","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","venue":"cs.CL","work_id":"8ba3cce8-4fc7-4286-9bae-513243ed4e6e","year":2024},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2412.14161","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:f12045e3180ecec45c5257a838c47dffc8506aa18903641a70dea2ca804e9c90","observation_id":"564ec014-cbcf-44b5-8908-7a5e74eb577a","resolution":{"observed_at":"2026-07-10T01:46:41.306236Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11381","last_updated":"2023-03-20T18:31:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-20T18:31:47Z","title":"MM-REACT: Prompting ChatGPT for Multimodal Reasoning and Action","version":1},"cited_work":{"arxiv_id":"2303.11381","doi":"10.48550/arxiv.2303.11381","metadata_source":"pith","pith_arxiv_id":"2303.11381","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MM-REACT: Prompting ChatGPT for Multimodal Reasoning and Action","venue":"cs.CV","work_id":"6dc43db8-227d-438e-8658-0c8acecba08a","year":2023},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2303.11381","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:ad49a35e5addab4f944fd553f41ee6159f051ba4b90b1dcc543079b023e59062","observation_id":"1bd81118-61fd-4dc2-b119-0c22a15550c2","resolution":{"observed_at":"2026-07-10T01:46:41.294757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T18:37:32.087006Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":"404308e4-3b7a-4845-8899-d58a0072d6ed","year":2022},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:ee8ec14c379bed7bf8fad0b095e921e61b84f73fab3c9205deb0bd3268844c01","observation_id":"608d9d32-0a63-478a-b4c0-ad640297fad4","resolution":{"observed_at":"2026-07-10T02:06:42.600044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-02T22:19:29.043854Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":"2406.12045","doi":"10.48550/arxiv.2406.12045","metadata_source":"pith","pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","venue":"cs.AI","work_id":"6a8d8dc4-0cc0-4052-8109-abbcdcd4a962","year":2024},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:b10db1bd7e1ec5bd19e90fbc16f121671d1045eea40e44f30cb2e3eb7a16c03c","observation_id":"bbdf3c80-57ef-4372-8541-1520e89b8f76","resolution":{"observed_at":"2026-07-10T01:46:41.271151Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06132","last_updated":"2026-05-07T14:06:23Z","snapshot_observed_at":"2026-07-06T22:54:40.349479Z","submitted_at":"2026-04-07T17:43:18Z","title":"Claw-Eval: Towards Trustworthy Evaluation of Autonomous Agents","version":3},"cited_work":{"arxiv_id":"2604.06132","doi":"10.48550/arxiv.2604.06132","metadata_source":"pith","pith_arxiv_id":"2604.06132","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Claw-Eval: Towards Trustworthy Evaluation of Autonomous Agents","venue":"cs.AI","work_id":"57acc3ec-f4c3-49ab-bd0f-5aab91002df9","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2604.06132","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:6d734abb3ff83ade0588b354c8daa69eae4a0b26a8906e23465aec7b3084724a","observation_id":"910fb33c-8da5-4d85-aede-bbea6563372f","resolution":{"observed_at":"2026-07-10T01:46:41.278931Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.573941Z","title":"Appagent: Multimodal agents as smartphone users","venue":null,"work_id":"adf77df2-5850-416e-845d-5aa0725cc5b3","year":2025},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:7a8722002cfe61b40126779a6ffaf2d2bbe916b2a596ff08843599dec376f19a","observation_id":"117fa3a6-179a-472e-90a1-f63767464268","resolution":{"observed_at":"2026-07-10T02:06:42.575188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.08523","last_updated":"2026-07-20T17:58:40Z","snapshot_observed_at":"2026-08-02T16:32:49.183734Z","submitted_at":"2026-04-09T17:57:13Z","title":"ClawBench: Can AI Agents Complete Everyday Online Tasks?","version":2},"cited_work":{"arxiv_id":"2604.08523","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.08523","snapshot_observed_at":"2026-07-10T01:46:41.301646Z","title":"ClawBench: Can AI Agents Complete Everyday Online Tasks?","venue":"cs.CL","work_id":"cb5e61b1-57bf-472b-825c-ddee917acd58","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2604.08523","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:e127601019b54a44227c17495272e6e14e1b921dca6888a8de48c4f3dd6e2eb6","observation_id":"0f998663-473f-4ec5-9072-19fa3d96ce85","resolution":{"observed_at":"2026-07-10T01:46:41.303337Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":"2307.13854","doi":"10.48550/arxiv.2307.13854","metadata_source":"pith","pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","venue":"cs.AI","work_id":"7058ffd2-a339-4102-89eb-248eeb074652","year":2023},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:2d13a7b29ef0748de6e1c5c3a872c35929e60535331556bd5af4746dbd7d42b6","observation_id":"4fcd13aa-bf9d-48cd-a05f-0fe6200f4998","resolution":{"observed_at":"2026-07-10T01:46:41.260658Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.579909Z","title":null,"venue":null,"work_id":"2d9f3ae8-1a39-41b4-bc9b-1bc76f67d47c","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:e7d86bef893a576e21358eff9c7d25bbfe01811b4b0b8415578f9d7f3c024ecc","observation_id":"7c5c15e3-cd75-4fbc-bce9-2c9064ee3fa5","resolution":{"observed_at":"2026-07-10T02:06:42.581046Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.581885Z","title":null,"venue":null,"work_id":"99a49a68-3aa2-4919-a511-e4bed630ddfd","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:e7029672a1dfbfe275b9cafad18e5faa599a9fe0d35c6ee0e3e235b9566dff57","observation_id":"15b0f5f7-0578-4d11-b649-e2c9649c9dae","resolution":{"observed_at":"2026-07-10T02:06:42.582963Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.589594Z","title":"draw the chart, compare it with the original, then revise","venue":null,"work_id":"9f92a160-1b9a-4011-9d2c-ea8c2a77f447","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:17d4850c79145a053eacc6fb41646333c49621f1441bc99a8f5c773a10af0ce3","observation_id":"039ceaf8-1e2f-45dd-b0be-c3bd739d3388","resolution":{"observed_at":"2026-07-10T02:06:42.590768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.587729Z","title":null,"venue":null,"work_id":"5e2bcacb-820e-4a9d-be00-724859d04502","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:89ded2786df86157e286ed5ece19f8b3b6923bd0b26ced1d52909303b74b14ee","observation_id":"47175f3d-8b84-47b2-8adb-0ade9f2a3aa5","resolution":{"observed_at":"2026-07-10T02:06:42.588817Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.604896Z","title":null,"venue":null,"work_id":"8dde1de8-294e-4e3a-91da-e877f5f1f341","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:5a66fe9b251fdf83210817b10b24665446fa6b575fd3bdb238c1e346ed270628","observation_id":"99b7afe3-6a5e-4ae0-adc0-1e24ecfbad58","resolution":{"observed_at":"2026-07-10T02:06:42.606031Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.574703Z","title":null,"venue":null,"work_id":"d8486fdd-4a49-4b55-8ea1-495a22cdac2e","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:7bf360b2665dcf289cac690d0891a5ccd72b516aff9789add35a24d206da5887","observation_id":"fb6427ec-5041-4602-b259-13466066a9e1","resolution":{"observed_at":"2026-07-10T02:06:42.575942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.564523Z","title":null,"venue":null,"work_id":"0ae4bc75-987f-4d37-ae91-9bd0de1da83b","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:190c954792c5ce0b4ddef5b54a917a74ea450982c4fe19902f14ff575c80faab","observation_id":"6db9b2c6-0cb3-4d99-bf11-26893eceb094","resolution":{"observed_at":"2026-07-10T02:06:42.565609Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.560244Z","title":"If a single screenshot cannot fit both, save an additional supplemental screenshot for the same artwork and mark that clearly in the filename or notes","venue":null,"work_id":"f81f2113-92d5-426c-a859-3c9689db5345","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:b037acefb897436c8bb58889bf0212de15716f2ef466081d4a1c86402707d7ca","observation_id":"4e09c213-a100-4345-8b6f-dd515a25be54","resolution":{"observed_at":"2026-07-10T02:06:42.561630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.549865Z","title":null,"venue":null,"work_id":"addae6b9-fe42-450d-ae7b-13091a9f1792","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:d9805cf617dfec5ed8ba877df11d3367a7ad4a9a6459f72bcb42dfb331bae21b","observation_id":"41257383-2bec-4324-a968-2dd77f3f558c","resolution":{"observed_at":"2026-07-10T02:06:42.550924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.546023Z","title":null,"venue":null,"work_id":"d7350ff4-dc48-41d0-94df-96fc94efaac1","year":2025},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:c82d1f8f79627385226c80273466a2572a4a9d913737552262fa46f0073c7c35","observation_id":"c725f40c-62a1-4fca-8d9c-64e5afa1245d","resolution":{"observed_at":"2026-07-10T02:06:42.547178Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.517223Z","title":null,"venue":null,"work_id":"21ab267f-9400-4637-a721-7b921bdbdfe9","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:e9bd282dcaa92278190a801538eff2a0e91fc9592ac2ed7cb2d9f4a908359d53","observation_id":"5b4959b6-8f2e-4ec9-b6a9-0d36af619937","resolution":{"observed_at":"2026-07-10T02:06:42.518733Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.610831Z","title":"The title must include `Rust Global: Tokyo`","venue":null,"work_id":"e3c76735-0b05-4749-abcc-451154faf576","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:0a6e415c1f1293602b23bbd982b7c810488a64a740011d50282579271817c68f","observation_id":"4c4f8707-01db-4c75-9304-693d942e30df","resolution":{"observed_at":"2026-07-10T02:06:42.612229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.556263Z","title":null,"venue":null,"work_id":"33ee69ca-9fdf-4c46-b6a4-fcec14f64fa2","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:7d2ae2ada30142556bc8b2ebabe5789337d89f3973a30b9691ae6c69002f8aaa","observation_id":"541c0032-91f1-49ea-9bd8-5f8fe5aad012","resolution":{"observed_at":"2026-07-10T02:06:42.557519Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.537709Z","title":null,"venue":null,"work_id":"b4e5ae73-627d-4b91-8c04-dd260357b178","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:4f9c7af7a15b1d84b25f2fac35e04333999b7bb2a570ee04fdd2e1225a84febd","observation_id":"d69fed6b-c5f9-4a9e-b353-37429e9257a0","resolution":{"observed_at":"2026-07-10T02:06:42.538813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.562131Z","title":"An ICS import preview, a screen where no calendar has been selected, or a dialog where import/save has not been clicked does not count as a created event","venue":null,"work_id":"8fcf2e59-e7b1-4e58-8490-c0354f7b28aa","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:3315f76851a3e1fc1b5e417131438dd566e370730050e9a3b29afae86615b75d","observation_id":"4b00de40-ef5d-471f-8be9-664dec6ca316","resolution":{"observed_at":"2026-07-10T02:06:42.563489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.595376Z","title":"Record the calendar application used, event title, start/end time, timezone, venue, registration link, and evidence file paths","venue":null,"work_id":"09286bc2-62bf-4d39-8fbc-704cfd940863","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:e8eb96f6740b552ada37a8599e30d838cdccece44d229ec78994dded5e1f7b91","observation_id":"ff4c3b34-8b7a-4349-9177-f9dcf2f1f927","resolution":{"observed_at":"2026-07-10T02:06:42.597673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.569991Z","title":"Available Images","venue":null,"work_id":"35a2a835-34fa-4cb3-af85-c16f2d3dfe4f","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:64d13bf82afaed3cfb044f806ee4e771ff7d8c6bcb24f6034648777a0c63bbca","observation_id":"35478cb7-e60a-4814-97ea-99fb26d5eb98","resolution":{"observed_at":"2026-07-10T02:06:42.571205Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.614093Z","title":null,"venue":null,"work_id":"c7e3a3cb-bfd4-4ffc-ae36-5b43ca099515","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:dacd99bfc145ad1ebb4754773724d8d909fa44bfa41d42c3fa07aff010783b51","observation_id":"0f646519-a7c1-47ef-b6aa-be4435c210bd","resolution":{"observed_at":"2026-07-10T02:06:42.615190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.528806Z","title":null,"venue":null,"work_id":"49681549-5ca4-4af1-a074-19af7b121bdf","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:1098bf91988622c21ce3d5e7662ab543d737960a65d841548b2500a43f889611","observation_id":"889b95a1-e0ae-46ff-9e05-fefdfe75cda8","resolution":{"observed_at":"2026-07-10T02:06:42.530037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.530680Z","title":"could be more thorough","venue":null,"work_id":"7f7380ea-a736-4129-a654-0b5b23432a16","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:5b4f0f3b61fff7529b95cc6a286853a8eaedce66d7467088d005a179cf28f679","observation_id":"6980910e-4299-4a7c-b7ee-0ec65b24d42b","resolution":{"observed_at":"2026-07-10T02:06:42.531746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.534245Z","title":null,"venue":null,"work_id":"bb344cc6-4439-4399-b738-3b3fcf25043e","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:cf6db108564f87950562002482033ec29643177bd44bc48ed884beabe87fe76c","observation_id":"4748ebd5-3f18-47b0-b6a1-0488db74c865","resolution":{"observed_at":"2026-07-10T02:06:42.535469Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.527021Z","title":null,"venue":null,"work_id":"fee20bd2-0eee-4142-a2e5-3fbcda62e440","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:fc8fb4fa4598a13935cc852fbe361f364ed6b6e0d9ec220838c0f4b94586a6c7","observation_id":"9118fe76-f7e1-4b25-9879-fb85c0d7393d","resolution":{"observed_at":"2026-07-10T02:06:42.528172Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.521269Z","title":null,"venue":null,"work_id":"cc9e7ec1-b65a-4222-a856-287ac9ea8d10","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:a14e33974303cf1ac3cfe74289376ad0dfd92e83ef9c2c113bbec278e740cc92","observation_id":"23b65796-e30f-4da1-85a2-089a29880450","resolution":{"observed_at":"2026-07-10T02:06:42.522549Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.523105Z","title":null,"venue":null,"work_id":"2b9e3dde-a5ae-42e8-86a5-09bba1ceb67f","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:6e1eab6fe45105ae67147b509884a619af7b67d8ca591961377994020da50167","observation_id":"7f11fd08-e904-4376-9311-a2f651548a23","resolution":{"observed_at":"2026-07-10T02:06:42.524366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.519395Z","title":"Now let me research the LOC API to understand how to find items with clear rights and accessible images","venue":null,"work_id":"0f1a5e74-6357-47dc-ae0f-a45f8b35d8f5","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:447d7e2c46887acc7215c696e50b485db609dcbd239bd3344cf9d86c6add611e","observation_id":"8eb27709-4fd5-41ef-9305-c5adacff5b04","resolution":{"observed_at":"2026-07-10T02:06:42.520711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.515068Z","title":"Cycle 1 has the right pipeline and the right data; only the selection rigor and the exclusion-file consistency are insufficient","venue":null,"work_id":"7a311e35-88e8-4754-be0d-849d718eb00d","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:6a1c0c538b52e858319b73084ccb0e82fa66029aaddc335808f597fe08579a14","observation_id":"fdc6f7fd-a875-4d4d-99a2-20e111748664","resolution":{"observed_at":"2026-07-10T02:06:42.516466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.532321Z","title":"Hidden judging assets are never mounted into the user simulator’s workspace, and a deterministic rewriter further sanitizes the simulator’s candidate text","venue":null,"work_id":"1a4cb969-d42e-4528-aa96-ac2e62410887","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:0320b061c8aadb8d45a92aeb80ac7cce422fdb5d15c6300359e24840bc1efa3b","observation_id":"958a5f1d-7180-48d7-93a4-562ed717ed6e","resolution":{"observed_at":"2026-07-10T02:06:42.533698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.512934Z","title":"UniClawBench scores reflect both the model’s first-pass and its recovery capabilities","venue":null,"work_id":"e4fd5d74-5302-4798-b096-dc22502b4c42","year":null},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:45fa08bd528ca210cc0c122745494cf6d82081d614c617579a4cb9333ccdb27b","observation_id":"60910144-a8b9-470e-8e4f-26fa6f2bb1dd","resolution":{"observed_at":"2026-07-10T02:06:42.514373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":17,"verified_exact":19,"verified_fuzzy":43},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 1 inbound Pith citation observation for arXiv:2607.08768."}