{"as_of":"2026-07-25T05:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d461f23864d8b2beb305abac8eb11bcce8becb35c3374f79ff1db99498bedeba","coverage":[{"denominator":6,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T04:03:43.178902Z","state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-24T06:31:00.690269+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T03:52:24.872919Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T20:48:55.530621Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"cited_work":{"arxiv_id":"2604.24964","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.24964","snapshot_observed_at":"2026-07-03T20:48:55.530621Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","venue":"cs.LG","work_id":"cb65e79f-cfcf-4117-82d1-3bb4d321f2a7","year":2026},"citing_paper":{"arxiv_id":"2605.16565","last_updated":"2026-05-19T13:45:27Z","snapshot_observed_at":"2026-07-06T23:27:43.762904Z","submitted_at":"2026-05-15T19:12:43Z","title":"Skim: Speculative Execution for Fast and Efficient Web Agents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T18:31:18.061863Z"},"links":{"cited_paper":"/paper/2604.24964","citing_paper":"/paper/2605.16565"},"observation_digest":"sha256:ecc3594dd1aa8c95247e7d2163e063e2e0aa1d1113f10bfecabb1c495a7008da","observation_id":"554c1696-ba81-4bbb-a3ae-a9dc1d2f1802","resolution":{"observed_at":"2026-05-20T18:33:38.048767Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"cited_work":{"arxiv_id":"2604.24964","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.24964","snapshot_observed_at":"2026-07-03T20:48:55.530621Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","venue":"cs.LG","work_id":"cb65e79f-cfcf-4117-82d1-3bb4d321f2a7","year":2026},"citing_paper":{"arxiv_id":"2606.05342","last_updated":"2026-06-05T17:19:56Z","snapshot_observed_at":"2026-07-06T23:45:23.749718Z","submitted_at":"2026-06-03T18:32:00Z","title":"SentinelBench: A Benchmark for Long-Running Monitoring Agents","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-28T06:09:38.698353Z"},"links":{"cited_paper":"/paper/2604.24964","citing_paper":"/paper/2606.05342"},"observation_digest":"sha256:435e2615c7be854460ca70b2b3decdb8f37558e4166f49e077da585ba9c2c116","observation_id":"6609e5a1-10e9-4a67-83d9-3ef91395a4b0","resolution":{"observed_at":"2026-07-02T08:16:48.331623Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"cited_work":{"arxiv_id":"2604.24964","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.24964","snapshot_observed_at":"2026-07-03T20:48:55.530621Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","venue":"cs.LG","work_id":"cb65e79f-cfcf-4117-82d1-3bb4d321f2a7","year":2026},"citing_paper":{"arxiv_id":"2606.17645","last_updated":"2026-06-16T08:04:35Z","snapshot_observed_at":"2026-07-06T23:53:11.869569Z","submitted_at":"2026-06-16T08:04:35Z","title":"Beyond Domains: Reusing Web Skills via Transferable Interaction Patterns","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T01:11:42.281859Z"},"links":{"cited_paper":"/paper/2604.24964","citing_paper":"/paper/2606.17645"},"observation_digest":"sha256:652779e7c74a147a323d623f0c0c6c3956bad4b223bcb8bf8db9c8be011c03db","observation_id":"64ac02ff-58a2-4471-883f-5b6dded84fd3","resolution":{"observed_at":"2026-07-03T20:48:55.532071Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.24964","snapshot_observed_at":"2026-07-13T03:52:24.872919Z","title":"Tomáš Koˇciský, Jonathan Schwarz, Phil Blunsom, Chris Dyer, Karl Moritz Hermann, Gábor Melis, and Edward Grefenstette","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09328","last_updated":"2026-07-23T17:56:03Z","snapshot_observed_at":"2026-07-25T04:21:37.988189Z","submitted_at":"2026-07-10T12:09:21Z","title":"WildTrace: Benchmarking Natural Evidence Trails in Long-Context Reasoning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T03:52:24.872919Z"},"links":{"cited_paper":"/paper/2604.24964","citing_paper":"/paper/2607.09328"},"observation_digest":"sha256:98b1d818f770a47e87238f78f00be68c8a7c03b74be9293681a0b070c04f3d75","observation_id":"3d3e510a-4885-4333-94c0-7cb3715972db","resolution":{"observed_at":"2026-07-13T03:52:24.872919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.24964/citation-record","integrity":"/paper/2604.24964/integrity","json":"/paper/2604.24964/citation-record.json","paper":"/paper/2604.24964"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Later steps must USE or BUILD ON information from earlier steps","venue":null,"work_id":"4eb6497c-25df-49dd-a4ab-64b04c36ed40","year":null},"citing_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T04:03:43.178902Z"},"links":{"citing_paper":"/paper/2604.24964"},"observation_digest":"sha256:69ee95a28da80552b7c7d44f90a89b973c5a0d454697aaea5ab00606eaecd1f6","observation_id":"80e7ec8e-769f-441d-b487-4005e3b42760","resolution":{"observed_at":"2026-05-26T21:23:05.194264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"eafc0f23-d09f-4a6c-b595-85e9aaff44c6","year":null},"citing_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T04:03:43.178902Z"},"links":{"citing_paper":"/paper/2604.24964"},"observation_digest":"sha256:deea9e4f04e99ad1c145ed798d32b40938751d32a130bf6a36660529873f15a8","observation_id":"c6c1f15e-6451-4122-ae80-8f6f8a024074","resolution":{"observed_at":"2026-05-26T21:23:05.202512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3754b4ef-a268-4ceb-a6e3-65db2ec8aefd","year":null},"citing_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T04:03:43.178902Z"},"links":{"citing_paper":"/paper/2604.24964"},"observation_digest":"sha256:dc5a74dc242242f53b2fd1387c529af895e80a488a465dac4dcbab0ad406ba7f","observation_id":"986ed7c7-0f34-41f0-8367-0c8e3efd3225","resolution":{"observed_at":"2026-05-26T21:23:05.190336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"63d9310c-928f-4405-a7ac-6b02f6cd0000","year":null},"citing_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T04:03:43.178902Z"},"links":{"citing_paper":"/paper/2604.24964"},"observation_digest":"sha256:7f39637a55ae6908dd07f2e81694d3fdba026244a4fc94dc012316a03b611e19","observation_id":"9e66c3b5-467b-4786-96c0-e61a8275f265","resolution":{"observed_at":"2026-05-26T21:23:05.206221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7f21543c-57db-4707-bfe7-7fcc86a69d75","year":null},"citing_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T04:03:43.178902Z"},"links":{"citing_paper":"/paper/2604.24964"},"observation_digest":"sha256:70a544aeb4e8f0705341031892913a9e9ba4a1e76951a7e036de80a0bce679be","observation_id":"b7ade058-53cd-4fed-bcd4-6211cdd5cfe1","resolution":{"observed_at":"2026-05-26T21:23:05.198262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"steps\": []","venue":null,"work_id":"89e24518-84dc-43d3-86eb-849aeb5ad3c8","year":2026},"citing_paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T04:03:43.178902Z"},"links":{"citing_paper":"/paper/2604.24964"},"observation_digest":"sha256:50c5231a9058a7a9bdf99990fc1976462eadf37e3b0f1c699e7e525a769411bf","observation_id":"4697b84d-8129-4994-9ff2-9fbb9d287b47","resolution":{"observed_at":"2026-05-26T21:23:05.186502Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-24T06:31:00.690269+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.24964","last_updated":"2026-04-27T20:05:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:10:52.763251Z","submitted_at":"2026-04-27T20:05:41Z","title":"Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks"},"reference_resolution":{"displayed":6,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":6},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-24T06:31:00.690269+00:00","source":"crossref"},{"observed_at":"2026-07-24T06:30:55.483554+00:00","source":"retraction_watch"}],"thesis":"As of 25 July 2026, this Paper Citation Record lists 6 of 6 outbound references and 4 inbound Pith citation observations for arXiv:2604.24964."}