{"as_of":"2026-08-07T11:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0128bde0d6f7195326e2c967a91e3fe70bbe3e7852fbca0bad5a0687d2e47a5e","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T05:09:49.912587Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T07:40:56.029050Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08888","snapshot_observed_at":"2026-07-13T03:52:24.872919Z","title":"Tianyu Gao, Howard Yen, Jiatong Yu, and Danqi Chen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09328","last_updated":"2026-07-23T17:56:03Z","snapshot_observed_at":"2026-08-05T04:17:50.821563Z","submitted_at":"2026-07-10T12:09:21Z","title":"WildTrace: Benchmarking Natural Evidence Trails in Long-Context Reasoning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T03:52:24.872919Z"},"links":{"cited_paper":"/paper/2605.08888","citing_paper":"/paper/2607.09328"},"observation_digest":"sha256:02460988beac0f9342c8fb0331eee50d3ded5814fb15d92c8a6917f470446737","observation_id":"3bc983a4-7311-4c23-9a07-123173bb822c","resolution":{"observed_at":"2026-07-13T03:52:24.872919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08888","snapshot_observed_at":"2026-08-02T07:40:56.029050Z","title":"Tianyu Gao, Howard Yen, Jiatong Yu, and Danqi Chen","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09328","last_updated":"2026-07-23T17:56:03Z","snapshot_observed_at":"2026-08-05T04:17:50.821563Z","submitted_at":"2026-07-10T12:09:21Z","title":"WildTrace: Benchmarking Natural Evidence Trails in Long-Context Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T07:40:56.029050Z"},"links":{"cited_paper":"/paper/2605.08888","citing_paper":"/paper/2607.09328"},"observation_digest":"sha256:52b9c9da9cd174fa5e1b2294de570b23c2dcb8ab7438017b96efb7bc00995c8f","observation_id":"197b182d-0c74-49dd-adfd-2f2f0e5128d3","resolution":{"observed_at":"2026-08-02T07:40:56.029050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.08888/citation-record","integrity":"/paper/2605.08888/integrity","json":"/paper/2605.08888/citation-record.json","paper":"/paper/2605.08888"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.08584","last_updated":"2026-01-13T14:06:03Z","snapshot_observed_at":"2026-08-04T17:10:53.354037Z","submitted_at":"2026-01-13T14:06:03Z","title":"Ministral 3","version":1},"cited_work":{"arxiv_id":"2601.08584","doi":"10.48550/arxiv.2601.08584","metadata_source":"pith","pith_arxiv_id":"2601.08584","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ministral 3","venue":"cs.CL","work_id":"6f314463-0f42-4eea-a5c3-607e733d6afe","year":2026},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"cited_paper":"/paper/2601.08584","citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:7ae8b7fc4f16dcaca3561b0ad2dadbb01d3f23cec95e5e5ff52368a00e2ef7b6","observation_id":"a448f9a8-a801-435d-8359-773500f4a891","resolution":{"observed_at":"2026-05-15T05:10:01.879289Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:23.713861+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:23.713861+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"No e x c e p t i o n s","venue":null,"work_id":"efd490f3-b5c9-4072-afbe-7e82f22c969a","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:1990ac67c21495ff3eeac594e3a286760674a52fc976c2d19ecc4a55efd80a53","observation_id":"57b1a8cc-7bf4-4ccd-aaf2-db7affba09e8","resolution":{"observed_at":"2026-05-15T05:10:02.233860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8ded5029-4535-4f63-b664-fb89bbf1f410","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:72b61a3b5206c8cb494c173a94714e50cc064342b3de0fa16059b2b6289fa322","observation_id":"c86db4e4-447a-4ad7-82d4-37366a1a8355","resolution":{"observed_at":"2026-05-15T05:10:02.247309Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The ci ta tio n MUST ,→ end with TWO right b rac ke ts ‘]] ‘ and then the period","venue":null,"work_id":"3210da9a-19c2-4785-95a6-5dc4d7208e0f","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:0b668caca106efd12f29b0cd3bbcddac8353e99641f154d9827bf6b7e0ffe9b2","observation_id":"f167d956-439c-4b3e-923f-28e59ab96787","resolution":{"observed_at":"2026-05-15T05:10:02.228958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"on ,→ page 5","venue":null,"work_id":"4057037d-2d37-4ad2-b7f1-8e59b9e5424b","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:1f2b5a716460f6e894fe5740a3b77c9385b61b305f121d4536bbc831aab94d17","observation_id":"920927d8-0a38-4175-bebf-3eb31fdf52c2","resolution":{"observed_at":"2026-05-15T05:10:02.243164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7c371237-4673-4e90-aa1e-55f949d9fd92","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:bc5f8bc718eece286f69d46492f71a5e2405ce95d6599fa7e3e4fe30c1adfd2b","observation_id":"51629ec7-1c03-4a4b-8fec-3701dc7dfdff","resolution":{"observed_at":"2026-05-15T05:10:02.191338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"12\" , \" ,→ iv","venue":null,"work_id":"42c6fe36-6274-4f1c-8e52-de67386671fa","year":2023},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:0fdcb994bae6a0b1f6562719c487408a4573bd4d86926cdc0a379633226bdb9b","observation_id":"69b47268-eb08-40e3-855e-fa9de797b2f6","resolution":{"observed_at":"2026-05-15T05:10:02.200217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e75a3d93-1dda-4bb4-ba3c-978a4167e6a7","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:f04400c2ae6d86050b17a8609bdafb65b9b694bc0c4ab2f3ba6328680701763d","observation_id":"1f8f8ee5-e840-47b8-8bee-98fdd819f121","resolution":{"observed_at":"2026-05-15T05:10:02.212816Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"on page X","venue":null,"work_id":"7df6ee66-bd8a-4f2d-b42b-cc0559855f29","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:36b999fb1cb9c18a6b8900c6f1a0f5e910cc29ac6dcaea502fb9adaaef28382a","observation_id":"a9faff63-5d42-44dd-9e1f-94c6230f420d","resolution":{"observed_at":"2026-05-15T05:10:02.208528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"covered","venue":null,"work_id":"86fbabc7-9925-401d-87f3-726499aeb0ca","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:4ef6f693a01e1cefd1d25c5031fb579269eb052b597cc970b12fb5ccf9b038e9","observation_id":"145168da-40c6-4e8a-aee6-a417704f73ea","resolution":{"observed_at":"2026-05-15T05:10:02.239189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"63719e4e-a7f8-4c5e-9cb0-369883574d48","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:8372ccbc3b1f6133add32ff665dc159a4cd308788b00243b1e6a968d0beb808f","observation_id":"1ba105c4-9f9d-4d29-8966-2e6593d6c5e8","resolution":{"observed_at":"2026-05-15T05:10:02.224410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"covered","venue":null,"work_id":"8b9d9cf7-7a35-4d44-a322-30c737d5212e","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:c27549d3146804ead497bdf84ab07904b0048857f006d3cbac9571b56ba6c827","observation_id":"7193d47b-87e6-417f-af6e-0e4f8a04cf8e","resolution":{"observed_at":"2026-05-15T05:10:02.251800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aef318d9-1b8f-40f2-ac06-db7689a3781a","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:a35ed4f4c19e7cffb23091c3b96b1e3a2d2b4f27a3be7a59604821c93970cd3b","observation_id":"46f82e03-feb4-4f34-84bd-5647f9cad484","resolution":{"observed_at":"2026-05-15T05:10:02.216683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"16 ,→ Mbytes","venue":null,"work_id":"18621887-fc4a-4723-87b1-813de4e09415","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:09f3857f7fa6fa890c53eff7668d5e9862da4ca2dd742bc724245479748bdc7d","observation_id":"7fdae806-390f-4dfd-b9ac-caf5417f081a","resolution":{"observed_at":"2026-05-15T05:10:02.195678Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4dc25a3c-1012-458f-850f-65a5b2be9fbb","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:77cde634c37f11e88042c0a83578c8a2558d237c2dd3ee8dac87a9c4eb4ae865","observation_id":"02230506-b7ef-4b2c-bc36-2daad283c3cf","resolution":{"observed_at":"2026-05-15T05:10:02.220567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0d81df0f-8ff3-4254-b547-b52435650cd6","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:b58de3944c5b0fc9b33688d068221ce14ea6363b266e6ff1b2c04c0067662439","observation_id":"14168a6c-7ec4-43de-a589-66bdf9e86509","resolution":{"observed_at":"2026-05-15T05:10:02.204210Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Missing ,→ req ui re d items or adding i n c o r r e c t extra items is i n c o n s i s t e n t","venue":null,"work_id":"53b851f7-66c5-40f5-9531-a17f8523782d","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:288c8422494982e2cc3a0ba019edd376111dca6a60bf584392e9f6448aee42aa","observation_id":"a5c37f48-0859-49b4-b8ad-bc28559e1768","resolution":{"observed_at":"2026-05-15T05:10:02.102976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7966f93c-d870-4ccb-a495-bbef5bb1c2b4","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:64f947517f4e1f22cd866a772b24c1f25599629718801a542ba55f2745101385","observation_id":"cc4a0c37-e64b-436c-b17a-5e330d26202a","resolution":{"observed_at":"2026-05-15T05:10:02.026329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"If ,→ the name clearly differs , mark it i n c o n s i s t e n t","venue":null,"work_id":"bf542191-a440-4bdc-8c9c-0949297bf40c","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:468f2efdda2d8731588f2418b0b935573167b5add181a9ad02e22723f3c06ba2","observation_id":"3b57aba0-c499-4b22-9f84-86cea5ceb97c","resolution":{"observed_at":"2026-05-15T05:10:02.116871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Judge only from question , gold_answer , and ,→ m o d e l _ a n s w e r","venue":null,"work_id":"230bfe3a-b667-42a4-a339-1ddbccc9baa9","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:9652ee7a558701eb2c24d5396fab913925ab6bc787f91035e4601d568ce73515","observation_id":"fa1de118-abf2-4915-b6a1-175f63a07f7f","resolution":{"observed_at":"2026-05-15T05:10:02.122539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"c o n s i s t e n t","venue":null,"work_id":"c2be295b-a89f-45fa-a35c-c2cf1bcae2cc","year":2000},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:add358c59c18bcfd9d84a40937eb5cff2a7a4d05d41d28ab1b6ff2c902d8dedb","observation_id":"b5957959-7eda-4fcb-b77f-ffc033b2c85d","resolution":{"observed_at":"2026-05-15T05:10:02.141830Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The input context is restricted to the gold evidence pages while retaining the standard reasoning prompt, removing the page-localization burden","venue":null,"work_id":"020aedc3-a068-4e85-9869-d91276d34c1c","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:bfaa69c98d98bb913efa7ada3e284df7716fe47e26486ad1b6a9c28c1eecfdaa","observation_id":"76f7f6b1-40d7-4c88-9f28-637647a5d871","resolution":{"observed_at":"2026-05-15T05:10:02.045556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Building on (1), textual bounding-box descriptions of key evidence re- gions are injected into the prompt, additionally removing the region-grounding burden","venue":null,"work_id":"5ce7c1de-0860-4c95-a48c-249e608dfaae","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:18888b855ae24a9fc41c458a0e08d95c93172904226f734602ac221c06d9cfe0","observation_id":"f3220c94-44fe-4f66-b01d-1ad59acdfb0f","resolution":{"observed_at":"2026-05-15T05:10:01.978235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Building on (2), the atomic facts contained in each annotated region are additionally provided, further removing the perceptual and fact-extraction burden","venue":null,"work_id":"9800b100-2af4-4994-9846-357b019b0010","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:99e466122c42375de2665ba214eda5d641ef34dc643c6e5c5f9d912fc09d2ba6","observation_id":"a0cebc6a-e3ed-48fe-8a4d-78946efdab46","resolution":{"observed_at":"2026-05-15T05:10:01.935329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A1: DocScope is a benchmark designed to evaluate the multimodal long-document understanding capabilities of models, primarily targeting question answering over long PDF documents","venue":null,"work_id":"ac391bd1-a857-43b6-9339-427e18afe7b0","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:6ecc54a995d27f24d24f5fe86d48ddfbdf987815a09048dad30d3a7bf039174b","observation_id":"ec060a3a-869f-4392-86a3-d6f7eb6cd73a","resolution":{"observed_at":"2026-05-15T05:10:01.991976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b6b06cdc-df4d-45d3-b0b5-65731df6cd17","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:d96e899614a578fdb1b2b634296d78b6f2b24264b21e779c2bdb2da750359a6f","observation_id":"d86938e4-a997-4361-8883-65e650b48f2c","resolution":{"observed_at":"2026-05-15T05:10:01.970400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"69604e1d-5b8b-4a08-9c1f-1db9690fa0c4","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:77d139d23e16d3d34720aed0240a2e4ca32ea8a06feeca95f25727315d3f5fbb","observation_id":"4200a799-c4c2-4988-b566-42d92fda20b9","resolution":{"observed_at":"2026-05-15T05:10:02.136698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A1: DocScope currently contains 1,124 QA instances, each consisting of a question and its corre- sponding answer grounded in a long document","venue":null,"work_id":"0554e6a1-aaa1-44e4-99ba-44c526fdd6a8","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:3267ac5eccc1ddce0a2d58e258bc590f060c17c3f25e1a88196f7bf0af093b95","observation_id":"0892faa7-2787-4e51-9822-f6bb379521ff","resolution":{"observed_at":"2026-05-15T05:10:02.074078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"647963d6-a509-4206-be8a-1166dd08fff9","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:1afece7617a248de004627fbc4385df570b2a690e99c481da254cdf3c67fc944","observation_id":"5a664cfd-f8cc-4bc5-a5de-09b3a1422b23","resolution":{"observed_at":"2026-05-15T05:10:02.173545Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The larger set consists of potential QA pairs constructed from real-world long documents","venue":null,"work_id":"005a4086-522e-4a61-960f-df833cf8e90d","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:8fe8d04c36be7aa9759066278a7e8c8b5894bec2717277466875c6ce7c5e758a","observation_id":"f4f1bb07-52f9-4b1e-bba1-a142f5e74073","resolution":{"observed_at":"2026-05-15T05:10:02.015125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The data are provided as raw document-based QA annotations rather than pre-extracted feature representations","venue":null,"work_id":"5dd0c11c-574f-415a-82cf-b8e29fe11481","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:1c7137395b216b66a12331b680f36e1a2a5cb7449b61c3e7ac32cab0c3920a36","observation_id":"dc7d8d41-0e3c-4268-b1ee-90ca76d73450","resolution":{"observed_at":"2026-05-15T05:10:02.039597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"47 A5: Y es","venue":null,"work_id":"16014a61-c022-41b6-8eca-68d748259d11","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:c7eb67722e38821de4636c618881512637f794da810958bc30ab3c786311d9e1","observation_id":"a02a5747-4eec-4a74-bd5b-8e8a9087b4be","resolution":{"observed_at":"2026-05-15T05:10:02.107079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"51df194e-bd87-4998-b057-09c1f747f15b","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:54d227a540a65bb49ab9883cd82cd4762cede956e072fea2c822419c3481d839","observation_id":"795300a3-5ffa-41e3-bc8d-a71fbfead302","resolution":{"observed_at":"2026-05-15T05:10:02.049735Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Instances are explicitly categorized by question type and answerability","venue":null,"work_id":"aaa73064-4dbf-4d17-8fc5-3d7969d001b2","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:3d36fdf8d95e2a9fd0c0e43197825b0972acf5b734a971e41433f203b2b5573a","observation_id":"1de1c7d1-8039-41b5-a324-e66a6dbf6295","resolution":{"observed_at":"2026-05-15T05:10:02.111841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"DocScope is primarily intended as an evaluation benchmark and is split into a validation set and a test set","venue":null,"work_id":"3bae8963-ecf0-4be6-b5ca-a7d465b5b464","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:70eff3aad4b991b702a34b05c6cf837542ef3b1cdf47fc9e21160b426250cc86","observation_id":"5366064d-b089-4cba-a13c-ce7ad60e0831","resolution":{"observed_at":"2026-05-15T05:10:02.055687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"However, as the QA pairs are synthesized from complex real-world long documents, residual annotation errors or ambiguous cases may still exist","venue":null,"work_id":"e23fdf00-ac00-48de-806d-173b8724af47","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:6011e792e233242734d34f6ec569021b925113646eb5a413c08598b13879ee5b","observation_id":"b50b2971-b40e-49f6-b0f4-21fdbe258ff9","resolution":{"observed_at":"2026-05-15T05:10:02.131748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The released dataset will include the source PDF documents, questions, answers, supporting evidence, evidence bounding-box coordinates, and factual reasoning annotations","venue":null,"work_id":"a40c4372-5a01-4f08-8ecd-2ac3f97f52b3","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:0b76f9798d61e816f27ebe009fed74f9d5caea09c117176181e94fdb092ead76","observation_id":"f6f5ad2e-5a8b-4deb-b336-1528d382f856","resolution":{"observed_at":"2026-05-15T05:10:02.182671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The source documents are publicly available documents, and the dataset does not inten- tionally contain conﬁdential information","venue":null,"work_id":"dda64ea4-df57-454d-b5fa-f6ff52a4f733","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:b7d0d2cbf8b5d43ab257d5ea7912e9466b29a6b22d4d86461fade10558e0870f","observation_id":"7eefc9cf-b22f-4ec6-8b27-328beed6952d","resolution":{"observed_at":"2026-05-15T05:10:02.060946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Manual review and ﬁltering were conducted to remove or mitigate offensive, toxic, or sensitive content","venue":null,"work_id":"5d82fbaf-3c8b-499e-9305-ebf32eafe22e","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:f7a03a32beaccad405724ab5d9672e04f8a12502bc322f873610ddde6041ba04","observation_id":"77f544a7-691f-46e0-aa12-e24b533021d2","resolution":{"observed_at":"2026-05-15T05:10:02.160149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"QA pairs were synthesized using Claude-Opus-4.6 and then strictly reviewed","venue":null,"work_id":"45afb58e-9bfe-4a01-bc43-ad78444bd8f1","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:d29a0db437e9553a86e7ec96d698f5bea7c52f068c8d3cc42311d570211f0090","observation_id":"b824bd3c-4eff-4621-8dea-9a7107ce9189","resolution":{"observed_at":"2026-05-15T05:10:02.155408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5bdd43ba-617d-4cf3-846a-0f4f805080bf","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:464618b733fa0c24d84b9b7ac3547d7f91c09b8e3f30cd5412980ed6d4be03fe","observation_id":"c9965207-8a82-4739-b0e5-e7dc40b5839a","resolution":{"observed_at":"2026-05-15T05:10:02.064837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c8dd6c48-29e8-4367-ab8a-5132bc0943d5","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:1b55958505b2990f8bee2df50edb4f548bbfa8c48bad62a79668e8e6aa87a46a","observation_id":"c4360f86-a3ab-492b-8c68-82abbd0210e3","resolution":{"observed_at":"2026-05-15T05:10:02.078785Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The annotators worked for approximately ﬁve days and were compensated","venue":null,"work_id":"2777b20c-b5c0-4651-ae78-fb696d4cce0c","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:1d9d17dedf51db7accc63f0ddfb06e9968bbb0963a7e283d071f16611db84e63","observation_id":"83becdf8-a0d7-4dc6-a45e-212498ae7f74","resolution":{"observed_at":"2026-05-15T05:10:02.083387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"48 H.4 Preprocessing/cleaning/labeling","venue":null,"work_id":"4e0a6f89-0a09-4700-bb27-e82286b9892f","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:730bba8aea873f30b1f6bea8fe74b1e6960ec556c1e33368338d8e5e0e38aa32","observation_id":"bf0a3dcd-eca2-4b6c-ab92-55f773aaa4c1","resolution":{"observed_at":"2026-05-15T05:10:01.957242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The dataset construction involved QA synthesis, evidence annotation, bounding-box an- notation, factual reasoning annotation, and strict review","venue":null,"work_id":"cc58ef75-f90b-4f47-8489-7a249af72ce1","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:4bb6dd49cf2b39788bac8c8576a8586065ad90cbef7c78cae8264135028ce605","observation_id":"eb9bbe3f-397b-40c7-9e5b-4cc1ef0dda14","resolution":{"observed_at":"2026-05-15T05:10:02.088878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Data decontamination was conducted through manual review and experimental checks to remove contaminated and duplicate instances","venue":null,"work_id":"35747925-7827-4c72-af98-c06ffe99e3a0","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:b89fc1215d786079c84002f4516306869081c4d81e139c16a9849e66e71cd888","observation_id":"97f69336-5d69-4bdd-b05e-270cb0a1b6fd","resolution":{"observed_at":"2026-05-15T05:10:02.094060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The tools and scripts used for data generation will be released","venue":null,"work_id":"7c1d84bb-a549-41a5-8bf7-8d4a657738df","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:886c55be507d8eae79c54a70dd61b9dbefaf09be9ddd875c325e30e0051185fc","observation_id":"62cfa16a-f83b-480a-a82e-8d158c3c24f3","resolution":{"observed_at":"2026-05-15T05:10:02.008581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A1: Y es","venue":null,"work_id":"918b40c4-fa56-4300-bb2b-351a7b34885f","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:b0be91657d314ecc7b4dd9a5a120f18ea5b0a743c5f038206e98bb003e3889d8","observation_id":"36982681-1e70-4509-b6ae-0b4af9ccb9df","resolution":{"observed_at":"2026-05-15T05:10:02.126783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0f4799a1-d163-430a-aed0-f5410c4f8e0a","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:6c99b0b80d37b6264d74e98bc708ab47a50812650e28903879c3c4c3bd1d0e52","observation_id":"4f1956e3-6249-402d-8f70-1e66c4248aa7","resolution":{"observed_at":"2026-05-15T05:10:02.146164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c0285836-6afe-4f6a-9f19-16e68e8f75c8","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:bcb2f5285bc82cd848f57a7399b22663d810dfce9d2e06168686bb9d28b7344c","observation_id":"5022467a-2f22-44ba-aff6-e0932be64858","resolution":{"observed_at":"2026-05-15T05:10:02.186560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fu- ture users should consider DocScope as an evaluation benchmark rather than a fully exhaustive representation of all long-document understanding scenarios","venue":null,"work_id":"78f65e4f-9c86-4a88-9929-9454049d6110","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:34d89e1ca2f4c4554be3427314926bf87bb8b21116006bfa2dae7eea8c2a33a2","observation_id":"abbb6a7d-c77d-43e3-9bfb-4cd2b6d1d24b","resolution":{"observed_at":"2026-05-15T05:10:01.942712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a6abd951-e851-4574-8bb0-3bdf48c8d83d","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:eb81e770a17afd058d1828967697d3da2ab8d8e3c7fefba7c380ac4766952a68","observation_id":"a9fe33b0-2c46-4315-985f-16944b3505db","resolution":{"observed_at":"2026-05-15T05:10:02.002529Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A1: Y es","venue":null,"work_id":"3cb93fdf-153c-4410-818f-d53f0ef4f5ae","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:415e448d992ab1253136b4b9733dabfa8529fa17dbfe9f0f95430b73905d0f35","observation_id":"313e5e20-d98e-4d81-b124-67fd3485e16c","resolution":{"observed_at":"2026-05-15T05:10:02.020615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"No DOI is currently available","venue":null,"work_id":"61465f69-2e14-4bf7-81d7-cc65750b1a19","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:770d1d9f2415ccb642d58a51973001598c138c024e5aea40695c04b9508eb73a","observation_id":"0043eaeb-96fe-4ffd-afbd-8dcd2daa996c","resolution":{"observed_at":"2026-05-15T05:10:02.177882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"569191bb-7157-496a-8616-1e6022298713","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:617422014a98220bf1865445f66b6009d08cf9d35fcd62e0d066080889dbf103","observation_id":"c4421f2a-320c-4658-9bda-eb926a71ebbb","resolution":{"observed_at":"2026-05-15T05:10:02.150586Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The dataset will be distributed under the Creative Commons Attribution-NonCommercial- ShareAlike 4.0 International License (CC BY -NC-SA 4.0)","venue":null,"work_id":"497cd552-1a18-4069-a5b7-2848f9856262","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:44b3740bf7d8874b0f5e6df13b7768e00da3050a12fbae0f14b7f4d0cb369f42","observation_id":"e222ea3d-0f27-4a80-8bfa-1da863fc0f7f","resolution":{"observed_at":"2026-05-15T05:10:02.164788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The source documents are from publicly available resources, and no third-party IP-based or other restrictions have been imposed on the dataset","venue":null,"work_id":"c5d10557-734d-44d0-a3ae-4169864e0ce4","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:4f5cb5c506228a6ee2a314636de2d12cb17a6f85d799f4af176b7f0293add693","observation_id":"414e4aff-d0f8-4606-a312-ba7e43abee8f","resolution":{"observed_at":"2026-05-15T05:10:01.984811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"H.7 Maintenance","venue":null,"work_id":"19349ceb-c338-4710-9398-7e134a926ce4","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:746c055314c402b22b1905567211a1580cd5fb727d9ce259d9c7e8ea23da8827","observation_id":"7948185d-7a60-480c-95cc-775cc7b88a85","resolution":{"observed_at":"2026-05-15T05:10:01.928197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b6cec311-af53-4fc1-a4fd-c979f876ea17","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:49e143fbb37779522a843fabf6491d19dd2bef4d0a4b5b5390d5b37fcdd4c6f0","observation_id":"b17bf033-bc56-4ff9-a100-51d42ae3968d","resolution":{"observed_at":"2026-05-15T05:10:02.098502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e26df724-a048-459d-833c-cb16790db9a6","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:9792e8ede74679ab0e3721171692dccad39fa61a675921adeaec45d89b4d3429","observation_id":"b754b1ad-0253-4549-aba0-4ed67531a899","resolution":{"observed_at":"2026-05-15T05:10:01.949874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A3: Any errata will be posted on the project GitHub repository","venue":null,"work_id":"50b6c664-f495-40b2-8dcd-697a001b7e3d","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:42c059ce9f00fe136d5e9a74707409d2cd1dd6c358137508ec45282763032895","observation_id":"1b583b51-8686-44d1-aa7c-a6d5ec0aaeee","resolution":{"observed_at":"2026-05-15T05:10:01.921063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The authors plan to update the dataset, and updates will be communicated through the ofﬁcial GitHub and Hugging Face repositories","venue":null,"work_id":"de29fff0-ecbe-462c-b935-46a8de040de6","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:151e24a6d38ab44c4106d28da24312bd8fa4f963cc736500373e9722c43b9d2d","observation_id":"1f24961f-54b9-4b02-a4ac-8888ff70ecc0","resolution":{"observed_at":"2026-05-15T05:10:01.964105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A5: Y es","venue":null,"work_id":"e51b540c-fe53-41c1-9a99-ac8bf12f5ee5","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:d85b330cc4741fc2ac2c274c4ffa5bdab4fd1cf40bb3533094e7a76342dddf80","observation_id":"1ed364e2-ff40-4124-9373-2349a1d91f59","resolution":{"observed_at":"2026-05-15T05:10:02.031523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b8a44cbe-cb49-4f69-8e8f-85045fa7c5f6","year":null},"citing_paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-15T05:09:49.912587Z"},"links":{"citing_paper":"/paper/2605.08888"},"observation_digest":"sha256:6344375dea7041540def3b836a19d822458146020c628d99f8b7a07a346e0128","observation_id":"1958ade6-f0c5-4aec-aca1-6c78f0f03d0f","resolution":{"observed_at":"2026-05-15T05:10:02.169297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.08888","last_updated":"2026-05-14T06:57:18Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:12:59Z","title":"DocScope: Benchmarking Verifiable Reasoning for Trustworthy Long-Document Understanding"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":41},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 2 inbound Pith citation observations for arXiv:2605.08888."}