{"as_of":"2026-08-14T13:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26dd8e42fd2c9d4311a6ae51fc4508cf9e474d429db92df715735d66483b57f8","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:39:08.452490Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T11:06:38.102348Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T11:11:27.550895Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"cited_work":{"arxiv_id":"2411.12395","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.12395","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Krojer, B., Komeili, M., Ross, C., Garrido, Q., Sinha, K., Ballas, N., and Assran, M","venue":null,"work_id":"8f9cb73a-3e81-47b7-98e9-5c73c6bbb639","year":null},"citing_paper":{"arxiv_id":"2602.13294","last_updated":"2026-05-21T07:15:56Z","snapshot_observed_at":"2026-08-02T05:44:45.001749Z","submitted_at":"2026-02-09T05:46:44Z","title":"VisPhyWorld: Probing Physical Reasoning via Code-Driven Video Reconstruction","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T11:06:38.102348Z"},"links":{"cited_paper":"/paper/2411.12395","citing_paper":"/paper/2602.13294"},"observation_digest":"sha256:c47585f30c03b2ddc58b29320d07d344c963838969983724b40f93092705e470","observation_id":"65801f10-9aa9-4555-ae5a-e38a67416de9","resolution":{"observed_at":"2026-05-22T11:11:27.554087Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.12395/citation-record","integrity":"/paper/2411.12395/integrity","json":"/paper/2411.12395/citation-record.json","paper":"/paper/2411.12395"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.903433Z","title":"56% of college students have used AI on assignments or exams: Bestcolleges,","venue":null,"work_id":"d803f1cf-5837-403a-b1ff-6f7b153348fb","year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.358990Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:763d29985aa9168071d8a694c2b95d4c471b3f14745a90aa5b57bf60bfc4303d","observation_id":"dd79d9b1-7380-466f-ab58-c8a12865509f","resolution":{"observed_at":"2026-08-12T17:39:08.907569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.890671Z","title":"Manjrekar","venue":null,"work_id":"d757d607-5a8a-4d5f-bf6d-692b451d35d6","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.363513Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:35c9f1fb6dee39c9597aa12648895f8e00273a63d19daf400d7a539df90c8f82","observation_id":"b7fba134-b158-4159-9e82-7fdd89f28d8f","resolution":{"observed_at":"2026-08-12T17:39:08.894498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01219","snapshot_observed_at":"2026-08-12T17:39:08.367529Z","title":"Siren’s song in the ai ocean: A survey on hallucination in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.367529Z"},"links":{"cited_paper":"/paper/2309.01219","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:f12c6990dfcefd1297010a17ae6f8b0e9f71f16e4d8f8a9424cd3e56e2606c48","observation_id":"120c83de-044f-4cd6-9322-4df3b20c7f5a","resolution":{"observed_at":"2026-08-12T17:39:08.367529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.371709Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.371709Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:eb2b77670d423a8ca120d84b17f3a320ea9d7b47bd7dc0a58020b45222f373f7","observation_id":"a434acd6-0841-4cf4-a452-fb353b979dcf","resolution":{"observed_at":"2026-08-12T17:39:08.371709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.12712","last_updated":"2023-04-13T20:41:31Z","snapshot_observed_at":"2026-08-03T04:49:15.195814Z","submitted_at":"2023-03-22T16:51:28Z","title":"Sparks of Artificial General Intelligence: Early experiments with GPT-4","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.12712","snapshot_observed_at":"2026-08-12T17:39:08.376028Z","title":"Sparks of artificial general intelligence: Early experiments with gpt-4,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.376028Z"},"links":{"cited_paper":"/paper/2303.12712","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:c44dd9cc53af24653ad076479a312d1f814be559a1f5fd58d8cf9530752ee0c7","observation_id":"a06bbfa9-ee43-40a4-8667-340e2f005c4b","resolution":{"observed_at":"2026-08-12T17:39:08.376028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.381029Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.381029Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:05aa7ed65c8dbc95c0566261ac1c734f7813051ec4d323e7fc8f3640bf5d224e","observation_id":"4c81cbad-95bf-491a-9a14-bb9bdbebf415","resolution":{"observed_at":"2026-08-12T17:39:08.381029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T17:39:08.385458Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.385458Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:13fb8049fe9dd27384e706eb65ae6bc6154971f696d7eaf73846d388e1ff869f","observation_id":"edf07336-dc48-4ab6-9669-655e786389f1","resolution":{"observed_at":"2026-08-12T17:39:08.385458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-12T17:39:08.389307Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.389307Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:006dd2d341ceb582b470920a8d42beb95adc2267be5b1a416e615609ba3f341e","observation_id":"3e003c7c-18cb-4c5c-bd27-11ade923dab2","resolution":{"observed_at":"2026-08-12T17:39:08.389307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-12T17:39:08.393263Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.393263Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:3cf30f3c9bca8604282cda24432e5ee1a3a386d1566ba01114031554383584be","observation_id":"03695bbc-4bfc-4842-bc74-c5760b1055bb","resolution":{"observed_at":"2026-08-12T17:39:08.393263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T17:39:08.397186Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.397186Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:fcc8cd580fffd5fbdd68ea0ab03076d8e29e50e69e610e85ea2cca7ad873eb30","observation_id":"3e7a26aa-8f41-4065-9a68-49dedbd208c0","resolution":{"observed_at":"2026-08-12T17:39:08.397186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.401394Z","title":"Instruction tuning for large language models: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.401394Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:11e00b8a17e0f20e9869eb332c4a4eaa503f102b4673e129d76a1a6abb854b71","observation_id":"42446af3-b266-4cf3-8a5b-9d7181cdb463","resolution":{"observed_at":"2026-08-12T17:39:08.401394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.860013Z","title":"Fighting fire with fire: can chatgpt detect ai-generated text?","venue":null,"work_id":"6174e37d-9ebe-40e3-8a41-85b3df2404f7","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.405159Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:809a832b8e487122626283930a6bc1c2d3fc4ca6c6046e1b80b6cb071edce6d6","observation_id":"115bdd92-df93-46d8-a240-b2764aad0616","resolution":{"observed_at":"2026-08-12T17:39:08.863853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12209","last_updated":"2024-05-20T17:52:29Z","snapshot_observed_at":"2026-08-13T15:51:50.035268Z","submitted_at":"2024-05-20T17:52:29Z","title":"MathBench: Evaluating the Theory and Application Proficiency of LLMs with a Hierarchical Mathematics Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12209","snapshot_observed_at":"2026-08-12T17:39:08.408800Z","title":"Mathbench: Evaluating the theory and application proficiency of llms with a hierarchical mathematics benchmark,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.408800Z"},"links":{"cited_paper":"/paper/2405.12209","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:eb8d491a4e6cdb1211c4c7bb268ac4ff59b86292dc1564e1b447770ab2120e14","observation_id":"b790d220-7b46-4551-bbe7-eadfd1481f07","resolution":{"observed_at":"2026-08-12T17:39:08.408800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03729","last_updated":"2024-04-01T20:56:11Z","snapshot_observed_at":"2026-08-13T04:47:30.687425Z","submitted_at":"2024-01-08T08:28:08Z","title":"The Butterfly Effect of Altering Prompts: How Small Changes and Jailbreaks Affect Large Language Model Performance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03729","snapshot_observed_at":"2026-08-12T17:39:08.412464Z","title":"The butterfly effect of altering prompts: How small changes and jailbreaks affect large language model perfor- mance,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.412464Z"},"links":{"cited_paper":"/paper/2401.03729","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:927a907f8e0a1bf4c796dee32926a5349ac10836f36261441b70bdfeb41ed6c8","observation_id":"3285a012-fc59-4c10-93a6-87c5269e170f","resolution":{"observed_at":"2026-08-12T17:39:08.412464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.846670Z","title":"Quantifying language models’ sensitivity to spurious features in prompt design or: How i learned to start worrying about prompt formatting,","venue":null,"work_id":"2e681879-f30f-41d9-8eb3-5c0679c1fbe9","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.416156Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:f433c7284d3e87f04cd5dd1a3b5ed43bbc442503c1f23d12368a9b7ca3372bdf","observation_id":"0c58a8ba-7cf8-4d05-b7e5-c781e7ea4439","resolution":{"observed_at":"2026-08-12T17:39:08.850880Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10711","last_updated":"2022-12-20T18:35:33Z","snapshot_observed_at":"2026-08-13T13:17:53.153921Z","submitted_at":"2022-12-20T18:35:33Z","title":"Task Ambiguity in Humans and Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10711","snapshot_observed_at":"2026-08-12T17:39:08.419760Z","title":"Task ambiguity in humans and language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.419760Z"},"links":{"cited_paper":"/paper/2212.10711","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:fc2196acd3ef927af49c6b0785415b5ed790e6be665701f328d5c96781c8911a","observation_id":"fcde1c31-717f-4f56-923b-320ea5e2a6f3","resolution":{"observed_at":"2026-08-12T17:39:08.419760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.834053Z","title":null,"venue":null,"work_id":"c50cb9aa-d820-4652-ba46-e2dfe9601518","year":null},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.423686Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:d67597aa1127a1286ec0cd5c0764509c106731bb99d0b3fa683f37c04fc09988","observation_id":"2d443af0-68d7-495b-acff-79f44d8a38d4","resolution":{"observed_at":"2026-08-12T17:39:08.838025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.820237Z","title":"The winograd schema challenge,","venue":null,"work_id":"b3744d45-bf90-45b3-973f-c56efdc48de0","year":2012},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.427497Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:f0e27eb24eefa5e09de10123f124c97883577e14ff1698a5a5723dcb6235ccc0","observation_id":"60877db6-650f-475a-8a3c-eae3a2054af7","resolution":{"observed_at":"2026-08-12T17:39:08.824823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.806433Z","title":"Gpt-4o system card,","venue":null,"work_id":"6ca25a83-2f59-4cca-a66a-de448157bf8c","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.431031Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:f7c9e9e8dec6cfdcc71fcc29857ad2670568cc24cbe0642cafd4ed4f53b63537","observation_id":"5d86b036-0ab5-48da-9192-963695f02871","resolution":{"observed_at":"2026-08-12T17:39:08.810453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.793005Z","title":"Natural questions: a benchmark for question answering research,","venue":null,"work_id":"bc93415a-9f46-43dc-8f14-3af020863d04","year":2019},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.434415Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:c116ebcdf8ff284107ca8ac6b44fb992c9b1ea7fe104f104e234105d0dbe097c","observation_id":"f4e1e5be-6b1d-4cca-8047-6bad97f4e02c","resolution":{"observed_at":"2026-08-12T17:39:08.797087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.779742Z","title":"AmbigQA: Answering ambiguous open-domain questions,","venue":null,"work_id":"df246282-0378-41ac-8039-ee123edc0f8f","year":2020},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.438058Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:040006847e24416762091c9bede0fbfa4949d0e35d641470fda78195cafaeee0","observation_id":"350d6fbc-e570-4e7b-b330-34ca0f244b95","resolution":{"observed_at":"2026-08-12T17:39:08.783784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.766704Z","title":"Scope ambiguities in large language models,","venue":null,"work_id":"84f0af22-8708-420e-978f-e4d0aad23a45","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.441544Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:99b0669232376bc2228a64271cafa5c6fc266e7845f76f0d68f592712f2c94c6","observation_id":"7a9ec339-6cfe-4d92-9cba-42f986aae223","resolution":{"observed_at":"2026-08-12T17:39:08.770656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-12T17:39:08.445089Z","title":"Mistral 7b (2023),","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.445089Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:d737e38efb0b546e7837116af5edb3e1a95b7a6c2906d38b304105f465b2b7ea","observation_id":"39706813-4643-43d5-bcda-7d4ecd053b7f","resolution":{"observed_at":"2026-08-12T17:39:08.445089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-08-10T01:52:30.559515Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-12T17:39:08.448804Z","title":"An empirical study of catastrophic forgetting in large language models during continual fine-tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.448804Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:0ca871768377e8bedb0bdc3996ddef4b0c5b67727eb8e99d8937ec9072c7fcc0","observation_id":"e4113f78-fd4e-47d4-a15b-9c74d6b13237","resolution":{"observed_at":"2026-08-12T17:39:08.448804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:39:08.751411Z","title":"Preserving principal subspaces to reduce catastrophic forgetting in fine-tuning,","venue":null,"work_id":"cc0f527a-8fef-4545-a508-5dec78670abb","year":2024},"citing_paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T17:39:08.452490Z"},"links":{"citing_paper":"/paper/2411.12395"},"observation_digest":"sha256:e795830c9aa27912cf390c2a566eeac4f5574e7abeccfe5b48f430348d70f4b6","observation_id":"142c4aa5-8cac-46e6-bf93-9ae4a50f416c","resolution":{"observed_at":"2026-08-12T17:39:08.757445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.12395","last_updated":"2024-11-19T10:27:26Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T04:46:28.940713Z","submitted_at":"2024-11-19T10:27:26Z","title":"Do LLMs Understand Ambiguity in Text? A Case Study in Open-world Question Answering"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":10},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 1 inbound Pith citation observation for arXiv:2411.12395."}