{"as_of":"2026-08-07T19:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7df2cba7606087a71a6fc7de6692698a0160493f5dd429a94d1b39b852d766a2","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T14:43:16.659316Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T05:41:39.396469Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T05:44:38.784930Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"cited_work":{"arxiv_id":"2509.23782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.23782","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bridging the knowledge-prediction gap in llms on multiple- choice questions","venue":null,"work_id":"7c7af8a1-6856-48ad-9c43-662f48b878c9","year":2025},"citing_paper":{"arxiv_id":"2605.22823","last_updated":"2026-05-21T17:59:56Z","snapshot_observed_at":"2026-07-30T22:55:34.671958Z","submitted_at":"2026-05-21T17:59:56Z","title":"Which Way Did It Move? Diagnosing and Overcoming Directional Motion Blindness in Video-LLMs","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T05:41:39.396469Z"},"links":{"cited_paper":"/paper/2509.23782","citing_paper":"/paper/2605.22823"},"observation_digest":"sha256:9882c1e19fda40e35954327e243b8732bc4a59476f5327e8533491d254c0eb31","observation_id":"b0fd5d4b-2ae4-4e1d-ab70-815f025a85b4","resolution":{"observed_at":"2026-06-02T03:04:01.145620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.23782/citation-record","integrity":"/paper/2509.23782/integrity","json":"/paper/2509.23782/citation-record.json","paper":"/paper/2509.23782"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:10.834850Z","title":"Understanding intermediate layers using linear classifier probes, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:10.834850Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:103b7ba2d4ade6189e729ced082598acb2d110e7ea58507539c32dece93c069e","observation_id":"d4861c87-8192-4d0b-b3f9-7c44bdf9b39e","resolution":{"observed_at":"2026-08-04T14:43:10.834850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:10.991738Z","title":"Refusal in language models is mediated by a single direction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:10.991738Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:90941b52dff9f26d8ca03a71b7a871054b6d4852fefcb39da5e5a056b32dbb4f","observation_id":"4fdcf6f6-aa45-452a-be66-1db39a2491e9","resolution":{"observed_at":"2026-08-04T14:43:10.991738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:11.125807Z","title":"The internal state of an LLM knows when it ' s lying","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:11.125807Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:2c880d55df2819d2d145f4faa31f2dcb7202cb1e464df1f05f30f3f32565f808","observation_id":"32bc3b33-4855-4780-ac24-39eefbe48f88","resolution":{"observed_at":"2026-08-04T14:43:11.125807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:11.254749Z","title":"Probing the geometry of truth: Consistency and generalization of truth directions in LLM s across logical transformations and question answering tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:11.254749Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:a4d329a427b4446805762d7a91fd128242a35a3b060acf20b6cd6243841fecae","observation_id":"a4dbe1c3-1615-497c-840c-7e3b527c8fd0","resolution":{"observed_at":"2026-08-04T14:43:11.254749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:11.344855Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:11.344855Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:8e3241a6b43bda9e2921bef0b1bf36ba7b1154a19f15f54437c7c8c1e5e7e484","observation_id":"e5cbb389-ec1f-41e0-a528-85b13efbd060","resolution":{"observed_at":"2026-08-04T14:43:11.344855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02856","last_updated":"2025-07-03T17:59:02Z","snapshot_observed_at":"2026-08-06T20:17:04.975842Z","submitted_at":"2025-07-03T17:59:02Z","title":"Answer Matching Outperforms Multiple Choice for Language Model Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02856","snapshot_observed_at":"2026-08-04T14:43:11.483898Z","title":"Answer matching outperforms multiple choice for language model evaluation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:11.483898Z"},"links":{"cited_paper":"/paper/2507.02856","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:3502a3e91c7b3f9dbeee999b1791aca8e47806ba2e1498186b7898c3ae0ed5ad","observation_id":"7c5363e6-c712-4c37-aa28-cbdd340f86bd","resolution":{"observed_at":"2026-08-04T14:43:11.483898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:11.584755Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:11.584755Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:6766ef96c5d8cfda0a26c10bb25b782011c7b9444e687a33158bdf1308ae1b30","observation_id":"b7cd00fa-fa5a-4de1-95df-e54156878fea","resolution":{"observed_at":"2026-08-04T14:43:11.584755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-04T14:43:11.694751Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:11.694751Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:ab4869a3acc0849ed5cdf355175f0b8b89622f0bb19eff2d558ae7c8427a9591","observation_id":"a6265235-1739-4e7b-b4a7-88de8c1336db","resolution":{"observed_at":"2026-08-04T14:43:11.694751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:11.774755Z","title":"Knowledge neurons in pretrained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:11.774755Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:0d7e40900ae9787404c85a1d8c2590c624c43178db1ee7efa8a2151e88fdfa1b","observation_id":"f6895e65-dd42-46a4-929b-509c7c8bc0b1","resolution":{"observed_at":"2026-08-04T14:43:11.774755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:11.954755Z","title":"Plug and play language models: A simple approach to controlled text generation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:11.954755Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:1bf8058024e3b82dfbdb1fe8617be3ef7841b4572d683fce37197215014f239f","observation_id":"aa81f760-e8e4-4f17-8f7e-2121feb525a4","resolution":{"observed_at":"2026-08-04T14:43:11.954755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15916","last_updated":"2023-10-24T15:17:14Z","snapshot_observed_at":"2026-08-07T03:42:41.198792Z","submitted_at":"2023-10-24T15:17:14Z","title":"In-Context Learning Creates Task Vectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15916","snapshot_observed_at":"2026-08-04T14:43:12.104751Z","title":"In-context learning creates task vectors, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:12.104751Z"},"links":{"cited_paper":"/paper/2310.15916","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:71825400a89bbaf893e10228816a2d6d42e44ace9963ff1f2e001aba64f5b950","observation_id":"bb0ef333-e192-411f-9aa1-fae9edeb02cb","resolution":{"observed_at":"2026-08-04T14:43:12.104751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:12.266840Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:12.266840Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:2daae61b886010f58db856e72fb5e0104834de94b00b660c48f59b55092a3843","observation_id":"fb4b5cdf-99b3-4f2c-a364-4d2c26d97398","resolution":{"observed_at":"2026-08-04T14:43:12.266840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:12.474741Z","title":"Lo RA : Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:12.474741Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:9a8415afeeceeabde677765a93a081cca468651c604a40029df168c3bb6e4d14","observation_id":"2d4ef28b-d407-497e-8804-bcffa2d9fc7a","resolution":{"observed_at":"2026-08-04T14:43:12.474741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04089","last_updated":"2023-03-31T15:27:01Z","snapshot_observed_at":"2026-08-03T22:12:27.993418Z","submitted_at":"2022-12-08T05:50:53Z","title":"Editing Models with Task Arithmetic","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04089","snapshot_observed_at":"2026-08-04T14:43:12.554747Z","title":"Editing models with task arithmetic, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:12.554747Z"},"links":{"cited_paper":"/paper/2212.04089","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:32f132a7162187e48127d0db7fb16cca3cf1d4d9ce1d2875ed8012e29662280e","observation_id":"4c8bab94-f220-462c-976b-10211c9efe78","resolution":{"observed_at":"2026-08-04T14:43:12.554747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:12.639855Z","title":"Lee, Inkit Padhi, Karthikeyan Natesan Ramamurthy, Erik Miehling, Pierre Dognin, Manish Nagireddy, and Amit Dhurandhar","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:12.639855Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:1b2bacbd3271c4e8737492b69d21313e4abb5f08a695383cf36af9e0f127ee22","observation_id":"8c20cf2e-6896-4ecb-8776-5cd00b577bf0","resolution":{"observed_at":"2026-08-04T14:43:12.639855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:12.724755Z","title":"Inference-time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:12.724755Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:d8b8019cf5b2fc793a6bdf20a98eedcc3783d952e2751782fe0c6855d37ab267","observation_id":"0e449c57-2bbf-41e4-a5c8-552fc7727168","resolution":{"observed_at":"2026-08-04T14:43:12.724755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:12.824752Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:12.824752Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:648a049c10b98e77ceae0b43c3f5b8743d6a11f19d7d32441c0ae0deebd525ae","observation_id":"dfb45d73-c2fc-4ae4-8573-2f0168c57871","resolution":{"observed_at":"2026-08-04T14:43:12.824752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00402","last_updated":"2024-02-01T07:48:50Z","snapshot_observed_at":"2026-07-31T01:05:21.643828Z","submitted_at":"2024-02-01T07:48:50Z","title":"Investigating Bias Representations in Llama 2 Chat via Activation Steering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00402","snapshot_observed_at":"2026-08-04T14:43:12.984764Z","title":"Investigating bias representations in llama 2 chat via activation steering, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:12.984764Z"},"links":{"cited_paper":"/paper/2402.00402","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:b5ac9355d6defaeb4630e7c97953002e1d916e3aed9db87b5933cab9293c8c63","observation_id":"bd241c84-4760-4714-894c-81c6e1b8090f","resolution":{"observed_at":"2026-08-04T14:43:12.984764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-04T14:43:13.214435Z","title":"The geometry of truth: Emergent linear structure in large language model representations of true/false datasets, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:13.214435Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:b04233cbd5190096fa21808f8464c1169477614422c4ad63251087404ca801c6","observation_id":"8ef1facb-36b6-4280-aa62-f53b12ec9d0a","resolution":{"observed_at":"2026-08-04T14:43:13.214435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:13.414745Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:13.414745Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:bd4aef4000fe34a2a2864bf5c966c887c23c370234f3d3be537873d2ee921558","observation_id":"12f9e328-d523-40cf-a968-0143306db352","resolution":{"observed_at":"2026-08-04T14:43:13.414745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:13.554750Z","title":"Introducing gpt-5","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:13.554750Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:b41927895aab0ad47b37da757b62148080c0a68b7742dc1e9edffbc1dc4f6c94","observation_id":"6e949ff8-2c33-4a7a-a8d8-bee0c97f1101","resolution":{"observed_at":"2026-08-04T14:43:13.554750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:13.676180Z","title":"LLM s know more than they show: On the intrinsic representation of LLM hallucinations","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:13.676180Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:a8718ea5a2b3da58b44b99c0ef859f409840ba70796cf3bf41003b7f9a77c776","observation_id":"769231bb-d2b5-4585-9799-61887f627ff2","resolution":{"observed_at":"2026-08-04T14:43:13.676180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:13.894756Z","title":"Large language models sensitivity to the order of options in multiple-choice questions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:13.894756Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:973efb289bb575ea8cac0aa739cdb4cb44579d232f36090c531a16c12d339929","observation_id":"89f8d6d1-c388-471b-901a-1952b944fca0","resolution":{"observed_at":"2026-08-04T14:43:13.894756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-04T14:43:14.064827Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:14.064827Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:6e705d38812054ddcd67ad1ca7ea0e3ef45e0e73624f2643b9a8022eb0c1205b","observation_id":"05c47a6d-4b5b-49c8-8907-a5480d2c89a6","resolution":{"observed_at":"2026-08-04T14:43:14.064827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:14.245491Z","title":"Steering llama 2 via contrastive activation addition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:14.245491Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:458e884c72e69cbbe104ab19258e3e5d8219f26a91e22b21399d86f35f0799e0","observation_id":"d8311e3c-ea13-4676-b1a3-10d99d7b1a63","resolution":{"observed_at":"2026-08-04T14:43:14.245491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:14.444798Z","title":"Layer by layer: Uncovering hidden representations in language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:14.444798Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:92d24ceacc6717c0c6948fe1602fbe1398c295c1f7fd1d92e55c5f330844d9c0","observation_id":"42bb0af7-1ac2-481a-b0e3-9d8bd3a65377","resolution":{"observed_at":"2026-08-04T14:43:14.444798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:14.604749Z","title":"Unsupervised real-time hallucination detection based on the internal states of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:14.604749Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:a3294a0ab99ce7944b81e216c806f627cd01c1b95c4b6dc85cc509916f4d2077","observation_id":"be4e53b3-807c-4d95-ad07-7ae34df46d9f","resolution":{"observed_at":"2026-08-04T14:43:14.604749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:14.784754Z","title":"Challenging BIG -bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:14.784754Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:eb1f2985b7e0572192f921949f195323f1aea8daed1dda6486bada51e9a2e668","observation_id":"de047cd8-163f-4db8-834e-aef3550c8341","resolution":{"observed_at":"2026-08-04T14:43:14.784754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-04T14:43:14.974820Z","title":"Llama 2: Open foundation and fine-tuned chat models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:14.974820Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:18b62c7c0f904c8d68be8afea77b42386ba4d8e65ac4670d72d7f1a103ee1df6","observation_id":"e2e3c5ee-8a7c-4fc2-a8b9-8080c4ee664a","resolution":{"observed_at":"2026-08-04T14:43:14.974820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:15.134753Z","title":"Steering language models with activation engineering, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:15.134753Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:fa73afe671103d67cd8639282077bcb5d5275faeb6d59a5f98c00db8c918be8f","observation_id":"e7997358-7fa8-421c-95c0-603d15ad6dfe","resolution":{"observed_at":"2026-08-04T14:43:15.134753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05328","last_updated":"2025-08-16T09:05:42Z","snapshot_observed_at":"2026-08-04T12:10:57.284437Z","submitted_at":"2024-06-08T02:59:52Z","title":"FacLens: Transferable Probe for Foreseeing Non-Factuality in Fact-Seeking Question Answering of Large Language Models","version":4},"cited_work":{"arxiv_id":"2406.05328","doi":"10.48550/arxiv.2406.05328","metadata_source":"pith","pith_arxiv_id":"2406.05328","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"FacLens: Transferable Probe for Foreseeing Non-Factuality in Fact-Seeking Question Answering of Large Language Models","venue":"cs.CL","work_id":"1b102e48-82d6-48e9-b9d5-36c0e818b005","year":2024},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:15.220082Z"},"links":{"cited_paper":"/paper/2406.05328","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:ba4293c9d96d195a82caf7c735509d53671c9ce85452f407b7a02740a8fe27c3","observation_id":"f7e4287d-2a93-4639-bea7-5c0ce74d9d53","resolution":{"observed_at":"2026-08-04T14:43:27.887348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:15.404755Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:15.404755Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:0d46b2b34483cf7f081e4199f9c3657c6aff6f9829b685b8d93669e60be964a7","observation_id":"b18fa2fb-756c-40fe-b15a-80ee93c497b5","resolution":{"observed_at":"2026-08-04T14:43:15.404755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:15.575227Z","title":"Large language models are not robust multiple choice selectors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:15.575227Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:4098a2e144f1aa9a2612ec7b34b9008d9e3594d14f767799ce18f01b2853ef9f","observation_id":"2861dfea-6645-4832-901a-d4f7d7302003","resolution":{"observed_at":"2026-08-04T14:43:15.575227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-04T14:43:15.684752Z","title":"Byun, Zifan Wang, Alex Mallen, Steven Basart, Sanmi Koyejo, Dawn Song, Matt Fredrikson, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:15.684752Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:26e016339a060d5ca9abda144a35e73458a577e6833950c47eae8bd6a79791ba","observation_id":"1724327b-ea3d-412a-899c-f0b9ff65cad1","resolution":{"observed_at":"2026-08-04T14:43:15.684752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:15.874752Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:15.874752Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:9434aea921324f4dbe51f438c31c10ca76d2d9ef96fa8ca5be83723271486776","observation_id":"acb733d1-9244-48e3-ba78-0aed45ec7483","resolution":{"observed_at":"2026-08-04T14:43:15.874752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:16.134895Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:16.134895Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:70ac7d90784bc28ed41312aad0b361c79f5b7506e84f1e77e214c6d9bd18ef39","observation_id":"44f902df-2182-40a0-b442-5ef5e894cd62","resolution":{"observed_at":"2026-08-04T14:43:16.134895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:16.324755Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:16.324755Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:ce986f9e474337fb8f6c9546a89df20f8133ed2781f4dbd14020e195248956a8","observation_id":"7a728661-918c-4066-9d0e-5049b5fe8a3d","resolution":{"observed_at":"2026-08-04T14:43:16.324755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T14:43:16.659316Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions","version":4},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T14:43:16.659316Z"},"links":{"citing_paper":"/paper/2509.23782"},"observation_digest":"sha256:65cdd8e8c41b08832963a720f58152cefa77bbc62d5c8567cde41b1f23787d7a","observation_id":"07a60ae9-8d01-490c-8a93-19b8e2ee472b","resolution":{"observed_at":"2026-08-04T14:43:16.659316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.23782","last_updated":"2026-06-01T03:35:05Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T14:43:07.447205Z","submitted_at":"2025-09-28T09:57:24Z","title":"Bridging the Knowledge-Prediction Gap in LLMs on Multiple-Choice Questions"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2509.23782."}