{"as_of":"2026-08-08T11:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2682bd5b9da2ba2a62c72d754eb93f5526f8c899379c38315f53bb26efd1238d","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:13:17.797667Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:22:44.774647Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:19:50.245560Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2512.03053","last_updated":"2026-04-16T21:39:03Z","snapshot_observed_at":"2026-08-02T21:53:03.786766Z","submitted_at":"2025-11-25T00:47:02Z","title":"Mitigating hallucinations and omissions in LLMs for invertible problems: An application to hardware logic design automation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-17T05:24:05.830241Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2512.03053"},"observation_digest":"sha256:2e8ed39b8a70e8a459153193a8f28d5bdeb2faf23c37dac5499569360eb20add","observation_id":"a529bcd7-92a9-4507-b7d0-d067eb575c35","resolution":{"observed_at":"2026-05-17T05:29:05.107544Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2604.26145","last_updated":"2026-05-22T17:07:34Z","snapshot_observed_at":"2026-07-06T23:11:52.954360Z","submitted_at":"2026-04-28T22:05:57Z","title":"Ceci n'est pas une explication: Evaluating Explanation Failures as Explainability Pitfalls in Language Learning Systems","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-07T15:12:00.081798Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2604.26145"},"observation_digest":"sha256:d8ab15526b35cf7668a6ad5bc1b5004a002ac8b71120e4a7df68822a890589cf","observation_id":"d5bceb12-34fd-4946-9055-885ddeb8c53e","resolution":{"observed_at":"2026-05-12T00:31:17.313713Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2604.26145","last_updated":"2026-05-22T17:07:34Z","snapshot_observed_at":"2026-07-06T23:11:52.954360Z","submitted_at":"2026-04-28T22:05:57Z","title":"Ceci n'est pas une explication: Evaluating Explanation Failures as Explainability Pitfalls in Language Learning Systems","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-25T06:31:00.249428Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2604.26145"},"observation_digest":"sha256:f5cfff70971e656b35a6e2dc05e4394d2bb97590f767e8a57743a00af571aeb6","observation_id":"27e3d2c1-b4be-484d-9a5b-c41848ca5ebf","resolution":{"observed_at":"2026-05-25T06:35:25.217000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2606.02680","last_updated":"2026-06-01T15:56:31Z","snapshot_observed_at":"2026-07-06T23:43:02.654629Z","submitted_at":"2026-06-01T15:56:31Z","title":"Locality Does Not Imply Reachability: Boundary Repair in Block-Sparse Causal Attention","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T15:34:46.265644Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2606.02680"},"observation_digest":"sha256:53515baa538a95fdfdd587967be5706e14d3b131769e8b38283a7d2303e29171","observation_id":"85b9209b-8f41-477c-a373-1c1bcf0298e8","resolution":{"observed_at":"2026-07-01T22:16:16.395398Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":"2506.11440","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-04T13:19:50.245560Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":"86829f56-885f-4074-83a8-248b3d67382d","year":2025},"citing_paper":{"arxiv_id":"2606.26529","last_updated":"2026-08-02T07:15:01Z","snapshot_observed_at":"2026-08-06T23:24:45.715072Z","submitted_at":"2026-06-25T02:09:08Z","title":"The inattentional gap in task conditioned AI models that omit otherwise reportable safety critical signals","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-26T05:24:11.228672Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2606.26529"},"observation_digest":"sha256:50f50515dbb898604cdd24c193736287037ea64b472cba4ae3610bbb9f992f51","observation_id":"3c3b00df-813b-4824-b32f-191aab9e1cd9","resolution":{"observed_at":"2026-07-04T13:19:50.247302Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-07-12T11:58:52.700648Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26529","last_updated":"2026-08-02T07:15:01Z","snapshot_observed_at":"2026-08-06T23:24:45.715072Z","submitted_at":"2026-06-25T02:09:08Z","title":"The inattentional gap in task conditioned AI models that omit otherwise reportable safety critical signals","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-12T11:58:52.700648Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2606.26529"},"observation_digest":"sha256:e85fc8cc4c3eaa831331b0de4b8826a333f6c76606f6d35ea1e8fbbe7ed9fba7","observation_id":"de7b2486-b4fc-40ae-9dac-3c900777e07b","resolution":{"observed_at":"2026-07-12T11:58:52.700648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-08-04T04:42:46.166372Z","title":"Y., Shrivastava, A., Moore, J., West, P., Tan, C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.26529","last_updated":"2026-08-02T07:15:01Z","snapshot_observed_at":"2026-08-06T23:24:45.715072Z","submitted_at":"2026-06-25T02:09:08Z","title":"The inattentional gap in task conditioned AI models that omit otherwise reportable safety critical signals","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T04:42:46.166372Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2606.26529"},"observation_digest":"sha256:a01605114fecc924348cd7a5ad3d78161a2053e0741ed1d726a9133845b5b210","observation_id":"c04a9899-bad2-4526-b63f-f5d0e9e2010e","resolution":{"observed_at":"2026-08-04T04:42:46.166372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11440","snapshot_observed_at":"2026-08-06T21:22:44.774647Z","title":"arXiv preprint arXiv:2506.11440 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04591","last_updated":"2026-08-05T08:53:16Z","snapshot_observed_at":"2026-08-08T11:11:18.753555Z","submitted_at":"2026-08-05T08:53:16Z","title":"When Absence Is Evidence: Evaluating Completeness-Sensitive Negative Reasoning in Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T21:22:44.774647Z"},"links":{"cited_paper":"/paper/2506.11440","citing_paper":"/paper/2608.04591"},"observation_digest":"sha256:83238b8d39505fdece697e0a112591360d7001ded89741aa29bd5c58c9899d29","observation_id":"f0cc3f5a-3a52-4705-8a0d-733ca1a87e7f","resolution":{"observed_at":"2026-08-06T21:22:44.774647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11440/citation-record","integrity":"/paper/2506.11440/integrity","json":"/paper/2506.11440/citation-record.json","paper":"/paper/2506.11440"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.11018","last_updated":"2024-10-17T17:45:09Z","snapshot_observed_at":"2026-07-06T18:01:18.745347Z","submitted_at":"2024-04-17T02:49:26Z","title":"Many-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11018","snapshot_observed_at":"2026-08-07T04:13:17.648452Z","title":"Zhang, Bernd Bohnet, Luis Rosias, Stephanie Chan, Biao Zhang, Ankesh Anand, Zaheer Abbas, Azade Nova, John D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.648452Z"},"links":{"cited_paper":"/paper/2404.11018","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:5f7957e8f4e663b9059fb4488f3fede7d734c1fcfe4606b4caf9f51dc4a9ef54","observation_id":"9bd0fe80-df29-4d2b-a589-d3c6b0e632c2","resolution":{"observed_at":"2026-08-07T04:13:17.648452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-07T04:13:17.652986Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.652986Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:544db9d9b826b85fd986cbab81b331a2dee87744064cf031769ee28198bf944e","observation_id":"dd26a989-0335-450d-9d89-aa1080f9a8d6","resolution":{"observed_at":"2026-08-07T04:13:17.652986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.11088","last_updated":"2023-10-04T10:04:25Z","snapshot_observed_at":"2026-07-06T15:56:38.019661Z","submitted_at":"2023-07-20T17:59:41Z","title":"L-Eval: Instituting Standardized Evaluation for Long Context Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.11088","snapshot_observed_at":"2026-08-07T04:13:17.656859Z","title":"L-eval: Instituting standardized evaluation for long context language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.656859Z"},"links":{"cited_paper":"/paper/2307.11088","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:adfe361d088f8d3a469ce030abc4e2652722d39b54961e4564ac3dcf58c5c465","observation_id":"56e6fd7a-77b1-4878-bb0d-11a3c679c1f8","resolution":{"observed_at":"2026-08-07T04:13:17.656859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.262574Z","title":"Bowman, Ethan Perez, Roger Baker Grosse, and David Duvenaud","venue":null,"work_id":"f263939f-8200-4956-82f6-93390f7940d7","year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.660267Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:dbc7b888fafec0ee05373ef6fdba0394a0f81840e3a3df8ee86d16693a47bebf","observation_id":"cdcc8374-c029-4222-ba5e-64aaaac30c8c","resolution":{"observed_at":"2026-08-07T04:13:18.265746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.253313Z","title":"Claude 3 haiku: our fastest model yet, 2024","venue":null,"work_id":"8b16802a-0542-4d16-8f7e-03fb5b618b0c","year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.663450Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:886f095f67e4a1638a7605ada3acf94c0d2f448a403fe95559740dfa3e714432","observation_id":"59e6c12b-1be1-44d5-aa28-03d6df593380","resolution":{"observed_at":"2026-08-07T04:13:18.256396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14508","last_updated":"2024-06-19T04:00:32Z","snapshot_observed_at":"2026-08-08T03:49:18.086396Z","submitted_at":"2023-08-28T11:53:40Z","title":"LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14508","snapshot_observed_at":"2026-08-07T04:13:17.666475Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.666475Z"},"links":{"cited_paper":"/paper/2308.14508","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:98d4a1223457a8095d6705dbd20a9f625640b7052400582b6beab165250437af","observation_id":"4b240ed1-6152-4706-af7c-a8f15e1ee392","resolution":{"observed_at":"2026-08-07T04:13:17.666475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01625","last_updated":"2023-10-30T19:44:47Z","snapshot_observed_at":"2026-07-06T15:22:25.008777Z","submitted_at":"2023-05-02T17:35:08Z","title":"Unlimiformer: Long-Range Transformers with Unlimited Length Input","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01625","snapshot_observed_at":"2026-08-07T04:13:17.670308Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.670308Z"},"links":{"cited_paper":"/paper/2305.01625","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:3b4f55c56d4758f721b866c3065989ac7f5eedb4760493420b361cd517b6e1df","observation_id":"26baed68-fc15-4741-9621-68208e1e5924","resolution":{"observed_at":"2026-08-07T04:13:17.670308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00785","last_updated":"2024-04-13T22:02:23Z","snapshot_observed_at":"2026-08-04T16:19:28.848684Z","submitted_at":"2023-10-01T20:46:44Z","title":"BooookScore: A systematic exploration of book-length summarization in the era of LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00785","snapshot_observed_at":"2026-08-07T04:13:17.673581Z","title":"Booookscore: A systematic exploration of book-length summarization in the era of llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.673581Z"},"links":{"cited_paper":"/paper/2310.00785","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:fa269c86374beb56c9036490495414fb5c0d6b564006028f448d3762851df28b","observation_id":"b11f4f4b-22c4-454e-8ca2-8d6c6f6f1730","resolution":{"observed_at":"2026-08-07T04:13:17.673581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15595","last_updated":"2023-06-28T04:26:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-27T16:26:26Z","title":"Extending Context Window of Large Language Models via Positional Interpolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15595","snapshot_observed_at":"2026-08-07T04:13:17.676871Z","title":"Extending context window of large language models via positional interpolation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.676871Z"},"links":{"cited_paper":"/paper/2306.15595","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:90d461c64f6c1e79e533909f61a5b00d2ad57e0a70c5f1f4441f4215df1e32a6","observation_id":"6acd2405-5ee4-40df-ae14-56d6fbbad1a0","resolution":{"observed_at":"2026-08-07T04:13:17.676871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-07T04:13:17.679986Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.679986Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:92550c7c0f57a27c2db4b8afd67fb212fe6d1560bada65dbb0bf0f57de46cbd6","observation_id":"b4aeb2d8-1861-4e57-b56d-81de0cdde438","resolution":{"observed_at":"2026-08-07T04:13:17.679986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:13:17.683266Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.683266Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:d3552840567748007ff10e6ebd61725f63e10f346b755d54ef2facd560255c06","observation_id":"86d5eac7-5bc7-4027-b66b-cf8d190b1f3c","resolution":{"observed_at":"2026-08-07T04:13:17.683266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13867","last_updated":"2023-07-20T17:59:14Z","snapshot_observed_at":"2026-07-06T14:46:45.009359Z","submitted_at":"2023-01-31T18:59:03Z","title":"Mathematical Capabilities of ChatGPT","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13867","snapshot_observed_at":"2026-08-07T04:13:17.686818Z","title":"Mathematical capabilities of chatgpt, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.686818Z"},"links":{"cited_paper":"/paper/2301.13867","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:f613abe1edb730cbf520be40617789fc8b2e2b0ef1d63128a1e073a7ec1c25a7","observation_id":"ce77bd0a-7837-4a4f-9fcd-ff3e30cd340a","resolution":{"observed_at":"2026-08-07T04:13:17.686818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06646","last_updated":"2023-02-13T19:19:23Z","snapshot_observed_at":"2026-07-30T21:20:28.504130Z","submitted_at":"2023-02-13T19:19:23Z","title":"Simple Hardware-Efficient Long Convolutions for Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06646","snapshot_observed_at":"2026-08-07T04:13:17.690031Z","title":"Fu, Elliot L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.690031Z"},"links":{"cited_paper":"/paper/2302.06646","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:64247d5787003637ab04ed0b384b6b8fa25fcac708143146d87fcaeab2df9d6f","observation_id":"8c8f867e-c763-44a5-b07b-fafc618db48c","resolution":{"observed_at":"2026-08-07T04:13:17.690031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:17.693121Z","title":"How to train long-context language models (effectively), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.693121Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:de406e09ae4a0554f14449bc9d675e237b1da43d61670a0b563c17798103ee3b","observation_id":"91348c31-eb1e-4342-aa92-49a2c48aff3f","resolution":{"observed_at":"2026-08-07T04:13:17.693121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.244457Z","title":"Gemini 2.5: Our most intelligent ai model, 2025","venue":null,"work_id":"f7c95de1-0204-4274-a3ca-4bc38df0f103","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.695912Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:242fd7763f4e5205ab302a3a2d0724f32fe8b529130d2d88b1ccc2311ca47b78","observation_id":"314cd94a-af43-44cc-b755-1474571bdac2","resolution":{"observed_at":"2026-08-07T04:13:18.247436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:13:17.699059Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.699059Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:0504c9ab56a28611d2179c5727f83a415b447e69874067e5fcbe7d13cdf9a96a","observation_id":"3a79523c-c853-49ec-a913-ac6ebc8bd7ff","resolution":{"observed_at":"2026-08-07T04:13:17.699059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T04:13:17.702868Z","title":"Mamba: Linear-time sequence modeling with selective state spaces, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.702868Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:52f920f0f3e296ad438c5adaac3f723c5454c779180f9e0eb807cafb97514830","observation_id":"95615ecf-e4c3-4f3f-afe8-9f3d94364ce2","resolution":{"observed_at":"2026-08-07T04:13:17.702868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-07-06T17:58:00.820879Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-08-07T04:13:17.705952Z","title":"Ruler: What's the real context size of your long-context language models?, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.705952Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:8a5007a56ad68de9696348487d00d3c2a5a688e7f2b08ce8f4df1446434db3b5","observation_id":"534072d9-ab58-442f-a018-96860604436e","resolution":{"observed_at":"2026-08-07T04:13:17.705952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T04:13:17.709044Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.709044Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:33fb99c52e49fa667085f7e86cf83e7abd112d180160c3434bccc5f137d71128","observation_id":"23c9b130-cb9c-4e0c-97d7-b9063af6f734","resolution":{"observed_at":"2026-08-07T04:13:17.709044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.235324Z","title":"Needle in a haystack - pressure testing llms, 2023","venue":null,"work_id":"943b5767-1da6-4cf6-b222-1ce53009a4f9","year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.712296Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:b2f770829b4b02b6f413bae75d31c2f1f1db63cda4e5fd6fbcfb5b7ed9378179","observation_id":"984be04b-3503-41a5-b086-912982775004","resolution":{"observed_at":"2026-08-07T04:13:18.238761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01261","last_updated":"2024-09-30T17:39:59Z","snapshot_observed_at":"2026-08-08T11:10:01.706250Z","submitted_at":"2024-04-01T17:33:38Z","title":"FABLES: Evaluating faithfulness and content selection in book-length summarization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01261","snapshot_observed_at":"2026-08-07T04:13:17.715567Z","title":"Fables: Evaluating faithfulness and content selection in book-length summarization, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.715567Z"},"links":{"cited_paper":"/paper/2404.01261","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:a7deb13bc316dd5d2eb1b0c432dc7624b1a349e11083550068353f73e73a9fa9","observation_id":"23c904a3-feed-4302-b6b7-fc1b8b932fd3","resolution":{"observed_at":"2026-08-07T04:13:17.715567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17012","last_updated":"2024-09-25T16:57:20Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T06:53:10Z","title":"Benchmarking Cognitive Biases in Large Language Models as Evaluators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17012","snapshot_observed_at":"2026-08-07T04:13:17.718512Z","title":"Benchmarking cognitive biases in large language models as evaluators, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.718512Z"},"links":{"cited_paper":"/paper/2309.17012","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:c6db4c5657991d6a9f9fb2c66cd4b677d5ec9c5f5ec63b7232a89a22bddd339a","observation_id":"6c134385-792b-4c51-9ea6-155b1800f4e3","resolution":{"observed_at":"2026-08-07T04:13:17.718512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.07040","last_updated":"2017-12-19T16:48:05Z","snapshot_observed_at":"2026-07-31T01:20:29.856066Z","submitted_at":"2017-12-19T16:48:05Z","title":"The NarrativeQA Reading Comprehension Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.07040","snapshot_observed_at":"2026-08-07T04:13:17.721714Z","title":"The narrativeqa reading comprehension challenge, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.721714Z"},"links":{"cited_paper":"/paper/1712.07040","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:5afc9aaf5c4d73a08811a41b96dafde597a2b69b7b25cdb8e6e0308adebf9a35","observation_id":"3e5344b0-c219-46e2-99c1-86b488710e7e","resolution":{"observed_at":"2026-08-07T04:13:17.721714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13121","last_updated":"2024-06-19T00:28:58Z","snapshot_observed_at":"2026-07-06T18:33:24.206083Z","submitted_at":"2024-06-19T00:28:58Z","title":"Can Long-Context Language Models Subsume Retrieval, RAG, SQL, and More?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13121","snapshot_observed_at":"2026-08-07T04:13:17.725291Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.725291Z"},"links":{"cited_paper":"/paper/2406.13121","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:9ef088cfab13e5ddb0fce212c45ef38f05cbcf1a9466468b0d4dba40ed17ff61","observation_id":"7bffc137-3dd6-44fc-9766-b3b995853ebb","resolution":{"observed_at":"2026-08-07T04:13:17.725291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.225762Z","title":"The llama 4 herd: The beginning of a new era of natively multimodal ai innovation, 2025","venue":null,"work_id":"5fca47bb-6c45-4e16-af12-a18eee20c828","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.728350Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:ac990b73610f469e646a91144d94f897849ac4ab38132f36832080512bfba36a","observation_id":"0f02fd82-05aa-4263-8a70-41a75902de14","resolution":{"observed_at":"2026-08-07T04:13:18.228912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.216588Z","title":"Openai o3-mini, pushing the frontier of cost-effective reasoning., 2025","venue":null,"work_id":"3a1636e1-f06f-4715-a46e-11314785e94f","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.731389Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:872442644abfd36651c7d001b2b094756f462bd953df59e5b9078d7cd21c1954","observation_id":"48a5b14c-7bf1-4424-8f5f-cd326fc48a71","resolution":{"observed_at":"2026-08-07T04:13:18.219852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T04:13:17.734425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.734425Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:9e4e9d927d6ac5757564c3b8a523a58d3a630d92aabc769a52f03dedf1ef049c","observation_id":"1f0529d3-daf8-4b7f-8057-ad04af79bf06","resolution":{"observed_at":"2026-08-07T04:13:17.734425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:13:17.737879Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.737879Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:0f37e792ba2103c770eee8210a4f68a8395de1f757a0ee8668fc97b9bcd5aaac","observation_id":"9e74647e-5850-4944-af1d-86d0873be01a","resolution":{"observed_at":"2026-08-07T04:13:17.737879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.207774Z","title":"gutenberg-poetry-corpus: A corpus of poetry from project gutenberg, 2018","venue":null,"work_id":"2672ce1e-17d9-4f1d-b162-ef66d81deeab","year":2018},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.741220Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:ac480cb6babe2c2e59011b6dce216c288605b695ac21ff1e0f54486ddea8d9b2","observation_id":"9ccfa6f8-8ac4-4fc3-a740-588bac6e9edd","resolution":{"observed_at":"2026-08-07T04:13:18.210950Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13048","last_updated":"2023-12-11T03:58:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-22T13:57:41Z","title":"RWKV: Reinventing RNNs for the Transformer Era","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13048","snapshot_observed_at":"2026-08-07T04:13:17.744118Z","title":"Wind, Stanislaw Wozniak, Ruichong Zhang, Zhenyuan Zhang, Qihang Zhao, Peng Zhou, Qinghua Zhou, Jian Zhu, and Rui-Jie Zhu","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.744118Z"},"links":{"cited_paper":"/paper/2305.13048","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:f4d6e9db013535215c646908513f85ec7a5942d03683cf3ef1125d87982876e5","observation_id":"0b8b784a-e963-4eea-88f9-63e0b67a47c8","resolution":{"observed_at":"2026-08-07T04:13:17.744118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.12409","last_updated":"2022-04-22T18:20:48Z","snapshot_observed_at":"2026-08-07T11:26:24.970964Z","submitted_at":"2021-08-27T17:35:06Z","title":"Train Short, Test Long: Attention with Linear Biases Enables Input Length Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.12409","snapshot_observed_at":"2026-08-07T04:13:17.747278Z","title":"Smith, and Mike Lewis","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.747278Z"},"links":{"cited_paper":"/paper/2108.12409","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:7df7997e502e8c1f7b74b0447dd77a521ab036dd6534a7f1b240a8c986d967cc","observation_id":"f0555fb9-7405-4359-b81d-a649a992860b","resolution":{"observed_at":"2026-08-07T04:13:17.747278Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.199005Z","title":"Qwen3 technical report, 2025 a","venue":null,"work_id":"ad61539f-cf60-4cfe-b660-798ba7685805","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.751186Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:f8da1869847193b122efa33dcd9dab9335898aefe7fbfe8c7e44fb161b6ce81e","observation_id":"0fb76f57-1b76-41a0-8d9c-66565c113efe","resolution":{"observed_at":"2026-08-07T04:13:18.202173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.189716Z","title":"Qwq-32b: Embracing the power of reinforcement learning, 2025 b","venue":null,"work_id":"bff0abe8-11a6-4ca6-b827-883190c1b7f2","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.754563Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:2c721be78f264e922d6e0e10e6c08549e42541fb10ebe7dd728fd5fcca238378","observation_id":"624fdfa1-57c7-4b31-aa60-6f6d80e6ebb9","resolution":{"observed_at":"2026-08-07T04:13:18.192878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-07T04:13:17.757980Z","title":"Code llama: Open foundation models for code, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.757980Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:2942457facb06a9ed7624dd79de3cb498c3c4bf2e28a2f76bb23a97a06c988e0","observation_id":"5ef853bc-f219-4f16-baf3-d60978a1bcf4","resolution":{"observed_at":"2026-08-07T04:13:17.757980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:17.761186Z","title":"Z ero SCROLLS : A zero-shot benchmark for long text understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.761186Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:31506258086ea6c928ce2bbc7eb61ea6833ff350b80e1b215897ebc3426f6826","observation_id":"6d8bb6cf-7172-4920-9c7b-ee88dc9a0926","resolution":{"observed_at":"2026-08-07T04:13:17.761186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-08-07T04:13:17.764087Z","title":"Roformer: Enhanced transformer with rotary position embedding, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.764087Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:7850805445f6d2f233d8f6733d9de51fef55d4be3eb78d30cc378c08d53d3403","observation_id":"5f5985b6-1d6a-4717-94f6-42bb50b8cfe6","resolution":{"observed_at":"2026-08-07T04:13:17.764087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10554","last_updated":"2022-12-20T18:56:20Z","snapshot_observed_at":"2026-08-05T12:58:36.921230Z","submitted_at":"2022-12-20T18:56:20Z","title":"A Length-Extrapolatable Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10554","snapshot_observed_at":"2026-08-07T04:13:17.767285Z","title":"A length-extrapolatable transformer, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.767285Z"},"links":{"cited_paper":"/paper/2212.10554","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:a5b84ba61ecf51d97904df8ffd79e9d6efed569aa2107c6b74962cbfdab302ba","observation_id":"779560ff-d125-4b76-a476-ab4d55c1d77c","resolution":{"observed_at":"2026-08-07T04:13:17.767285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:17.770366Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.770366Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:aeb8ca0a5a51034d81b8aafaa7bacc8733d014217b73f4f9cc6c27171c46ce18","observation_id":"ef0c8129-be67-40d4-8a09-820e953193ad","resolution":{"observed_at":"2026-08-07T04:13:17.770366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12640","last_updated":"2024-09-20T00:47:33Z","snapshot_observed_at":"2026-07-06T19:18:04.618039Z","submitted_at":"2024-09-19T10:38:01Z","title":"Michelangelo: Long Context Evaluations Beyond Haystacks via Latent Structure Queries","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12640","snapshot_observed_at":"2026-08-07T04:13:17.773223Z","title":"Michelangelo: Long context evaluations beyond haystacks via latent structure queries, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.773223Z"},"links":{"cited_paper":"/paper/2409.12640","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:fde15c1dddd297f5b9ae14b53ec6e1102b522d8e70af345ea1c4ab0b0b5c23de","observation_id":"41be1d9e-0019-4b67-bfaf-49151455a136","resolution":{"observed_at":"2026-08-07T04:13:17.773223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12766","last_updated":"2025-04-23T12:52:18Z","snapshot_observed_at":"2026-07-06T17:47:02.560132Z","submitted_at":"2024-03-18T17:32:32Z","title":"NovelQA: Benchmarking Question Answering on Documents Exceeding 200K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12766","snapshot_observed_at":"2026-08-07T04:13:17.776432Z","title":"Novelqa: Benchmarking question answering on documents exceeding 200k tokens, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.776432Z"},"links":{"cited_paper":"/paper/2403.12766","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:f6436a6410b788b762e76b6c89c47d7650e9f2c4668eaac8ed34a55fec2fb38a","observation_id":"f6b28314-4984-4097-8f42-ffe392ba4c02","resolution":{"observed_at":"2026-08-07T04:13:17.776432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:13:18.172965Z","title":"Grok 3 beta — the age of reasoning agents, 2025","venue":null,"work_id":"3cfd4ab0-55f5-4cb7-b2c5-3fc2145011c4","year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.779538Z"},"links":{"citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:a55daf2fc8fd85580538b3d363c748de6e8cf07c9b40a630e019ac88545a5175","observation_id":"e8c5b1f1-76a0-45ce-9e64-548cd4be8f3a","resolution":{"observed_at":"2026-08-07T04:13:18.177910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16695","last_updated":"2024-12-02T20:23:49Z","snapshot_observed_at":"2026-08-08T10:04:03.139121Z","submitted_at":"2024-07-23T17:57:41Z","title":"Stress-Testing Long-Context Language Models with Lifelong ICL and Task Haystack","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16695","snapshot_observed_at":"2026-08-07T04:13:17.782387Z","title":"Stress-testing long-context language models with lifelong icl and task haystack, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.782387Z"},"links":{"cited_paper":"/paper/2407.16695","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:513910747af69806b4d2a7e170994562dc681d836e3cc41f682e6a9cc7d54fde","observation_id":"77426410-528d-43a0-a526-55cec043c59f","resolution":{"observed_at":"2026-08-07T04:13:17.782387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T04:13:17.785799Z","title":"Qwen2.5 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.785799Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:04d06b8eb2a8c5bfa96223f77029f31ecaadbabcb91c1c4bbe72fed8c6915d99","observation_id":"0416608e-094e-4f4f-a4c2-4a20a02e5fc6","resolution":{"observed_at":"2026-08-07T04:13:17.785799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16617","last_updated":"2024-06-11T18:54:13Z","snapshot_observed_at":"2026-08-06T05:28:31.850302Z","submitted_at":"2024-02-26T14:47:35Z","title":"Long-Context Language Modeling with Parallel Context Encoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16617","snapshot_observed_at":"2026-08-07T04:13:17.788599Z","title":"Long-context language modeling with parallel context encoding, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.788599Z"},"links":{"cited_paper":"/paper/2402.16617","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:1affc356e2c5182330fb738cb168c9ebf6390d2354bf2b606cff206b97566ffe","observation_id":"102efd5b-655b-4ab6-ba39-f87b1ae4a122","resolution":{"observed_at":"2026-08-07T04:13:17.788599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02694","last_updated":"2025-03-06T18:41:54Z","snapshot_observed_at":"2026-08-06T10:41:12.245173Z","submitted_at":"2024-10-03T17:20:11Z","title":"HELMET: How to Evaluate Long-Context Language Models Effectively and Thoroughly","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02694","snapshot_observed_at":"2026-08-07T04:13:17.791605Z","title":"Helmet: How to evaluate long-context language models effectively and thoroughly, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.791605Z"},"links":{"cited_paper":"/paper/2410.02694","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:ed99c2c812cde810512623cedbe3640f9fcaf9df66beadc6a2939293ddce126e","observation_id":"23303ff9-36c3-4125-bd84-9493b8df1701","resolution":{"observed_at":"2026-08-07T04:13:17.791605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T04:13:17.794692Z","title":"bench: Extending long context evaluation beyond 100k tokens, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.794692Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:95b25a16a35a5830ea3c3deb8d9c17518e6aa4f5a0381fbc2e8fc8fe5c213b05","observation_id":"f936a41a-b2a4-4d44-b710-f6820d013140","resolution":{"observed_at":"2026-08-07T04:13:17.794692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-07T04:13:17.797667Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T04:13:17.797667Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2506.11440"},"observation_digest":"sha256:48bcffad2d698944c9f3415f37ff528292f57d0febe5206098f55b6d799dd3a8","observation_id":"0e55bcf3-5a6b-4018-9736-12d0dcdedbaf","resolution":{"observed_at":"2026-08-07T04:13:17.797667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11440","last_updated":"2025-06-13T03:38:29Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T04:06:34.003190Z","submitted_at":"2025-06-13T03:38:29Z","title":"AbsenceBench: Language Models Can't Tell What's Missing"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 8 inbound Pith citation observations for arXiv:2506.11440."}