{"as_of":"2026-08-06T18:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:50b972bf471a9d7585137b81d4897bd2bbabce7e543813c8100ce584e2ce5fff","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T06:36:52.202847Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T00:36:15.758892Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-11T01:37:42.725645Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"cited_work":{"arxiv_id":"2604.23781","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23781","snapshot_observed_at":"2026-07-11T01:37:42.725645Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","venue":"cs.CV","work_id":"d318932b-5733-4526-a467-d57db0337db5","year":2026},"citing_paper":{"arxiv_id":"2605.27882","last_updated":"2026-08-05T16:49:39Z","snapshot_observed_at":"2026-08-06T18:18:18.543834Z","submitted_at":"2026-05-27T03:06:18Z","title":"VibeSearchBench: Benchmarking Long-horizon Proactive Search in the Wild","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-29T13:14:07.487577Z"},"links":{"cited_paper":"/paper/2604.23781","citing_paper":"/paper/2605.27882"},"observation_digest":"sha256:dbfaa05d6d21cb32ef1064f2d391484e4173e038aa72588b5f20bdd066c3d946","observation_id":"8e670151-85ff-468d-a7c7-b5031919b87b","resolution":{"observed_at":"2026-06-29T13:23:28.378969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"cited_work":{"arxiv_id":"2604.23781","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23781","snapshot_observed_at":"2026-07-11T01:37:42.725645Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","venue":"cs.CV","work_id":"d318932b-5733-4526-a467-d57db0337db5","year":2026},"citing_paper":{"arxiv_id":"2606.12344","last_updated":"2026-06-10T17:16:23Z","snapshot_observed_at":"2026-08-02T03:07:28.486057Z","submitted_at":"2026-06-10T17:16:23Z","title":"Claw-SWE-Bench: A Benchmark for Evaluating OpenClaw-style Agent Harnesses on Coding Tasks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T10:39:51.630229Z"},"links":{"cited_paper":"/paper/2604.23781","citing_paper":"/paper/2606.12344"},"observation_digest":"sha256:34d064d152ea4fa3844c21d6a7402e6a9031120b628d56b65e9cc6383a7099d9","observation_id":"903180f3-6562-4001-8539-c9c014c8b650","resolution":{"observed_at":"2026-07-03T08:57:47.643579Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"cited_work":{"arxiv_id":"2604.23781","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23781","snapshot_observed_at":"2026-07-11T01:37:42.725645Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","venue":"cs.CV","work_id":"d318932b-5733-4526-a467-d57db0337db5","year":2026},"citing_paper":{"arxiv_id":"2607.06008","last_updated":"2026-07-09T11:01:43Z","snapshot_observed_at":"2026-07-12T23:17:38.931960Z","submitted_at":"2026-07-07T08:50:09Z","title":"PolyWorkBench: Benchmarking Multilingual Long-Horizon LLM Agents","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-08T20:03:47.212663Z"},"links":{"cited_paper":"/paper/2604.23781","citing_paper":"/paper/2607.06008"},"observation_digest":"sha256:8286d6c05b36009b1ed379314e92155c0369fdb32d25a79ff2b076be8c73e3a2","observation_id":"6b12aacc-012d-4920-bf42-26f09ecb7724","resolution":{"observed_at":"2026-07-08T20:05:34.094932Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"cited_work":{"arxiv_id":"2604.23781","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23781","snapshot_observed_at":"2026-07-11T01:37:42.725645Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","venue":"cs.CV","work_id":"d318932b-5733-4526-a467-d57db0337db5","year":2026},"citing_paper":{"arxiv_id":"2607.06008","last_updated":"2026-07-09T11:01:43Z","snapshot_observed_at":"2026-07-12T23:17:38.931960Z","submitted_at":"2026-07-07T08:50:09Z","title":"PolyWorkBench: Benchmarking Multilingual Long-Horizon LLM Agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-11T01:37:23.646537Z"},"links":{"cited_paper":"/paper/2604.23781","citing_paper":"/paper/2607.06008"},"observation_digest":"sha256:dfe5a3d46cd326f04a1ccaa6b860b56a99f6a0289821fa9a31b9c37bf5b18540","observation_id":"b3611f80-5451-40c1-96e3-10bec46c0c40","resolution":{"observed_at":"2026-07-11T01:37:42.757410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"cited_work":{"arxiv_id":"2604.23781","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.23781","snapshot_observed_at":"2026-07-11T01:37:42.725645Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","venue":"cs.CV","work_id":"d318932b-5733-4526-a467-d57db0337db5","year":2026},"citing_paper":{"arxiv_id":"2607.08768","last_updated":"2026-07-09T17:59:32Z","snapshot_observed_at":"2026-08-06T09:12:31.516517Z","submitted_at":"2026-07-09T17:59:32Z","title":"UniClawBench: A Universal Benchmark for Proactive Agents on Real-World Tasks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-10T01:39:57.741032Z"},"links":{"cited_paper":"/paper/2604.23781","citing_paper":"/paper/2607.08768"},"observation_digest":"sha256:6406376e1b3ccfa7cec55b021e4fdf50d3df65be57a743b11979d20c12d8b5e7","observation_id":"eade2889-5875-4bbc-859a-1e97167440ab","resolution":{"observed_at":"2026-07-10T01:46:41.270682Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.23781","snapshot_observed_at":"2026-08-02T00:36:15.758892Z","title":"Clawmark: A living-world benchmark for multi-turn, multi-day, multimodal coworker agents.arXiv preprint arXiv:2604.23781, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.14989","last_updated":"2026-07-16T13:38:07Z","snapshot_observed_at":"2026-08-06T13:31:27.325267Z","submitted_at":"2026-07-16T13:38:07Z","title":"OmniaBench: Benchmarking General AI Agents Across Diverse Scenarios","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T00:36:15.758892Z"},"links":{"cited_paper":"/paper/2604.23781","citing_paper":"/paper/2607.14989"},"observation_digest":"sha256:08e864c6794201f5c1d668d8707aeb2c718011fbd6a934b3e38c8970493f8773","observation_id":"35d0ddb8-f4d3-4ac4-920f-1a718e7be0cb","resolution":{"observed_at":"2026-08-02T00:36:15.758892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.23781/citation-record","integrity":"/paper/2604.23781/integrity","json":"/paper/2604.23781/citation-record.json","paper":"/paper/2604.23781"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-02T22:19:29.043854Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":"2406.12045","doi":"10.48550/arxiv.2406.12045","metadata_source":"pith","pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","venue":"cs.AI","work_id":"6a8d8dc4-0cc0-4052-8109-abbcdcd4a962","year":2024},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:54706dbd7073f34744d603b69d7260e9fa838e01142f4b3c59fc606c07a5a0cb","observation_id":"c745d5cd-947d-45b1-b23e-3be81c733c16","resolution":{"observed_at":"2026-05-11T21:11:10.841344Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07718","last_updated":"2024-07-23T06:19:28Z","snapshot_observed_at":"2026-08-02T12:09:24.340284Z","submitted_at":"2024-03-12T14:58:45Z","title":"WorkArena: How Capable Are Web Agents at Solving Common Knowledge Work Tasks?","version":5},"cited_work":{"arxiv_id":"2403.07718","doi":"10.48550/arxiv.2403.07718","metadata_source":"pith","pith_arxiv_id":"2403.07718","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WorkArena: How Capable Are Web Agents at Solving Common Knowledge Work Tasks?","venue":"cs.LG","work_id":"5ac27d9e-4522-46f8-985e-0e4f73130803","year":2024},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2403.07718","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:e68083345b1bc30442748c2bad7c39efbdccbf763d70a4bdbdf0254d3de94561","observation_id":"43f1aa7d-cb1e-489a-9b73-05e2b84d18a4","resolution":{"observed_at":"2026-05-15T02:48:05.307585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14161","last_updated":"2025-09-10T08:35:19Z","snapshot_observed_at":"2026-08-01T16:27:28.241667Z","submitted_at":"2024-12-18T18:55:40Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","version":3},"cited_work":{"arxiv_id":"2412.14161","doi":"10.48550/arxiv.2412.14161","metadata_source":"pith","pith_arxiv_id":"2412.14161","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TheAgentCompany: Benchmarking LLM Agents on Consequential Real World Tasks","venue":"cs.CL","work_id":"8ba3cce8-4fc7-4286-9bae-513243ed4e6e","year":2024},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2412.14161","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:b702479f9e5f6d73f48a475b7ab301efa1fe1266a53a5546ff0a6be470b3e4f4","observation_id":"5408acbf-6df5-4556-a7e8-0321276c6aab","resolution":{"observed_at":"2026-05-14T22:39:31.128039Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visualwebarena: Evaluating multimodal agents on realistic visual web tasks","venue":null,"work_id":"b70a5c4f-dcd2-4f70-bca7-734a32be494f","year":2024},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:9b69717c3e4b8a2b3845a226ba438433fc6bdf46673de0a7aa23426cd728217c","observation_id":"c3412cfb-7adf-412f-bf95-825aa7babade","resolution":{"observed_at":"2026-05-26T18:38:14.480542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T02:06:42.601003Z","title":"Osworld: Benchmarking multimodal agents for open-ended tasks in real computer environments.Advances in Neural Information Processing Systems, 37:52040–52094","venue":null,"work_id":"56792ea8-ed96-4503-89ff-a4fd69b3f98b","year":2024},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:06b9231f9902c2b0aeba9a4b4d729d40eea8abb8961530195f82a17dc84c8a7e","observation_id":"1396d387-47a3-4eb3-b6a0-a488517f3dad","resolution":{"observed_at":"2026-05-26T18:38:14.472468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-08-06T12:47:01.809185Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":"2307.13854","doi":"10.48550/arxiv.2307.13854","metadata_source":"pith","pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","venue":"cs.AI","work_id":"7058ffd2-a339-4102-89eb-248eeb074652","year":2023},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:0ef6915829f56690f610335368b70d2868cea6e632cb8ef6e5261b55d2f76e80","observation_id":"e170de81-13c1-4c27-8264-99aa5a626e3e","resolution":{"observed_at":"2026-05-11T21:11:10.918407Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11868","last_updated":"2026-01-17T01:29:30Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-17T01:29:30Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","version":1},"cited_work":{"arxiv_id":"2601.11868","doi":"10.48550/arxiv.2302.01973","metadata_source":"pith","pith_arxiv_id":"2601.11868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","venue":"cs.SE","work_id":"0624be05-1d97-4fd6-8300-b04b8a3ab04b","year":2026},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2601.11868","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:2ff8762c302462ac8823f769ade0e48d669acb3b83a30aad187cd6566d0e0537","observation_id":"a4525fe0-769f-415d-9c41-d2dbc0339314","resolution":{"observed_at":"2026-05-11T21:11:10.854057Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.24002","doi":"10.48550/arxiv.2509.24002","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mcpmark: A benchmark for stress-testing realistic and comprehensive mcp use","venue":"ArXiv.org","work_id":"5b1fa0f7-d604-4d0f-85f2-a2e91356834d","year":2025},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:754a6862e2818173768b5e4ba66333b40df3d45bc34faecb6cd4c41fbac29158","observation_id":"d9df3b27-bbb1-4b22-a4f1-1df1e37fed2a","resolution":{"observed_at":"2026-05-11T21:11:10.898917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06132","last_updated":"2026-05-07T14:06:23Z","snapshot_observed_at":"2026-07-06T22:54:40.349479Z","submitted_at":"2026-04-07T17:43:18Z","title":"Claw-Eval: Towards Trustworthy Evaluation of Autonomous Agents","version":3},"cited_work":{"arxiv_id":"2604.06132","doi":"10.48550/arxiv.2604.06132","metadata_source":"pith","pith_arxiv_id":"2604.06132","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Claw-Eval: Towards Trustworthy Evaluation of Autonomous Agents","venue":"cs.AI","work_id":"57acc3ec-f4c3-49ab-bd0f-5aab91002df9","year":2026},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2604.06132","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:eca6aad4b4adf90fe005c37c23bf8a2ed4343cc497cc4da5bf62d1b3e4bcd071","observation_id":"889a55d8-3cc0-4ed2-a100-c62caa90a053","resolution":{"observed_at":"2026-05-11T21:11:10.795764Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.05172","last_updated":"2026-04-08T09:27:21Z","snapshot_observed_at":"2026-07-06T22:54:00.211106Z","submitted_at":"2026-04-06T21:09:06Z","title":"ClawsBench: Evaluating Capability and Safety of LLM Productivity Agents in Simulated Workspaces","version":2},"cited_work":{"arxiv_id":"2604.05172","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05172","snapshot_observed_at":"2026-07-03T06:07:41.480446Z","title":"ClawsBench: Evaluating Capability and Safety of LLM Productivity Agents in Simulated Workspaces","venue":"cs.AI","work_id":"1d0d802c-947a-4c92-8995-c392b01261d7","year":2026},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2604.05172","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:405e758b9b4a1ef5a4ef68925f7a963a93b6516382a6bbb9e2273b5af59c6afa","observation_id":"ec1f690c-0094-4a98-a97a-41eb93f7fb8a","resolution":{"observed_at":"2026-05-11T21:11:10.876875Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:36:22.361197Z","title":"Mind2web: Towards a generalist agent for the web.Advances in Neural Information Processing Systems, 36:28091–28114","venue":null,"work_id":"11ebf5e9-ce0a-48b6-8ddf-e267c900004c","year":2023},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:3e4e131c65e35f53e3152d6b20c75ed84e349825ea1c0c003e09739d0a46f151","observation_id":"77bd5cdf-05b7-48af-a50d-d0e1c6ece492","resolution":{"observed_at":"2026-05-26T18:38:14.484838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20453","last_updated":"2025-08-28T05:58:57Z","snapshot_observed_at":"2026-08-05T15:10:31.464813Z","submitted_at":"2025-08-28T05:58:57Z","title":"MCP-Bench: Benchmarking Tool-Using LLM Agents with Complex Real-World Tasks via MCP Servers","version":1},"cited_work":{"arxiv_id":"2508.20453","doi":"10.48550/arxiv.2508.20453","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.20453","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wang et al","venue":"ArXiv.org","work_id":"09a5d0b4-4a61-4a3e-a239-f3d9368305d5","year":2025},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2508.20453","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:5d1bff6c4c8621d2da689a4aa5ca98c9c4c82ace5356c6871a28ef4c130f3a76","observation_id":"df550c02-dd52-459a-aed6-c25951f65292","resolution":{"observed_at":"2026-05-11T21:11:10.779830Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06770","last_updated":"2024-11-11T23:05:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T16:47:29Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","version":3},"cited_work":{"arxiv_id":"2310.06770","doi":"10.1145/512927.512945","metadata_source":"pith","pith_arxiv_id":"2310.06770","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SWE-bench: Can Language Models Resolve Real-World GitHub Issues?","venue":"cs.CL","work_id":"d0effe15-a689-441a-8e3f-ea35f1c4e4b1","year":2023},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2310.06770","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:aee158212115c83f40c8b8b8edbd42fc5440b21914f20e5d401accd4f24aa4bb","observation_id":"2b1ea6ea-9559-4c50-b4e6-2ca1d7d62910","resolution":{"observed_at":"2026-05-11T21:11:10.882978Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03688","last_updated":"2025-10-04T03:54:18Z","snapshot_observed_at":"2026-08-04T04:48:34.061129Z","submitted_at":"2023-08-07T16:08:11Z","title":"AgentBench: Evaluating LLMs as Agents","version":3},"cited_work":{"arxiv_id":"2308.03688","doi":"10.1109/fllm63129.2024.10852426","metadata_source":"pith","pith_arxiv_id":"2308.03688","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgentBench: Evaluating LLMs as Agents","venue":"cs.AI","work_id":"a37549b4-4c94-412d-acc4-4efeb08509be","year":2023},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2308.03688","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:74376ae68cb8d7b87ab4db7caf3b9148675c40bf45a77a60cf01e9e4f6d1fe13","observation_id":"0ca1a61a-1aae-4786-ae12-899f465d57d1","resolution":{"observed_at":"2026-05-11T21:11:10.925570Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaia: a benchmark for general ai assistants","venue":null,"work_id":"057919e3-b78b-4b6c-a8e5-58c25e672ccf","year":2023},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:0464acbc35518b2918656dbf4773a21b0cab06c6656b30b9872259a05480f67c","observation_id":"53ed90ca-aa7b-4bdc-a015-497c18def0b8","resolution":{"observed_at":"2026-05-26T18:38:14.476310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04202","last_updated":"2026-05-16T15:44:46Z","snapshot_observed_at":"2026-08-01T03:44:06.431113Z","submitted_at":"2026-04-05T17:55:23Z","title":"ClawArena: Benchmarking AI Agents in Evolving Information Environments","version":2},"cited_work":{"arxiv_id":"2604.04202","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04202","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ClawArena: Benchmarking AI Agents in Evolving Information Environments","venue":"cs.LG","work_id":"177dafeb-01c2-4b16-96f2-d33a422009b9","year":2026},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2604.04202","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:52d35f38013c61620d552c8994859d67df36108e533a43c92b7d16245110f1e6","observation_id":"b21eccad-d261-4c1d-aead-73eb8ef2d31e","resolution":{"observed_at":"2026-05-11T21:11:10.906594Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T13:24:54.955583Z","title":"Swe-agent: Agent-computer interfaces enable automated software engineering.Advances in Neural Information Processing Systems, 37:50528–50652","venue":null,"work_id":"0621aa9d-3c5d-4171-ba59-3d6fb78d570d","year":2024},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:dbce1473b740a674c12f83c71e49593ce118a28005204d26722e7193929f08b3","observation_id":"22252659-e486-4d29-934b-cc202fd46ae7","resolution":{"observed_at":"2026-05-26T18:38:14.488632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T13:33:50.923956Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversations","venue":null,"work_id":"e57ce12a-7d16-4d21-a253-28bdb8094e1a","year":2024},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:85ee5d6efb435bc8163e45190d47f253a16bdebc7d685ed308d093dc18337593","observation_id":"4aaa25e5-9a7c-4c13-a291-38dbfdc45c9f","resolution":{"observed_at":"2026-05-26T18:38:14.465276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00352","last_updated":"2024-11-01T14:36:52Z","snapshot_observed_at":"2026-07-06T16:01:07.532053Z","submitted_at":"2023-08-01T07:49:10Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","version":7},"cited_work":{"arxiv_id":"2308.00352","doi":"10.48550/arxiv.2308.00352","metadata_source":"pith","pith_arxiv_id":"2308.00352","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MetaGPT: Meta Programming for A Multi-Agent Collaborative Framework","venue":"cs.AI","work_id":"891b9780-a800-4e3c-bba0-53597ab8dc98","year":2023},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"cited_paper":"/paper/2308.00352","citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:d9cad9d93447dcdc205ae52da3f5fe5aa59803e27886c47423ff0dde02d4200c","observation_id":"79e1908f-7616-4582-af63-ef7707d9240f","resolution":{"observed_at":"2026-05-11T21:11:10.806436Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Day 1 / Day 2 / Day 3","venue":null,"work_id":"143aafa4-d59c-43e4-8e56-a358bd6b7176","year":2023},"citing_paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T06:36:52.202847Z"},"links":{"citing_paper":"/paper/2604.23781"},"observation_digest":"sha256:ad990b1d4b3a1ba7af36f9a2a9c7120f15881da61ea889650340b2da1c96bff8","observation_id":"3f9702e2-a8e0-442e-94f1-e1f5dff331f7","resolution":{"observed_at":"2026-05-26T18:38:14.468512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.23781","last_updated":"2026-05-05T15:32:46Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:09:58.193241Z","submitted_at":"2026-04-26T16:05:02Z","title":"ClawMark: A Living-World Benchmark for Multi-Turn, Multi-Day, Multimodal Coworker Agents"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":0,"verified_exact":12,"verified_fuzzy":7},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 6 inbound Pith citation observations for arXiv:2604.23781."}