{"as_of":"2026-08-09T16:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a8f29aeda4af2aa019be445fef7b98119a6ea690beeb469a453f20593ed02d94","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:12:08.926105Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:47:08.564508Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T13:24:53.352590Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"cited_work":{"arxiv_id":"2509.09396","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.09396","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"David Mickisch, Felix Assion, Florens Greßner, Wiebke G ¨unther, and Mariele Motta","venue":null,"work_id":"097b6cb7-95f3-4093-bcbf-541bb835a70c","year":null},"citing_paper":{"arxiv_id":"2510.03271","last_updated":"2026-05-21T09:16:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-27T07:42:54Z","title":"Decision Potential Surface: A Theoretical and Practical Approximation of Large Language Model Decision Boundary","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T13:22:37.107679Z"},"links":{"cited_paper":"/paper/2509.09396","citing_paper":"/paper/2510.03271"},"observation_digest":"sha256:1c23d6b893d1464caf8fa8846b4cd349b9c58f9e0aa9190af0a05a482f725249","observation_id":"25970723-dd10-498d-af0c-addf14098659","resolution":{"observed_at":"2026-05-22T13:24:53.354890Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09396","snapshot_observed_at":"2026-08-03T00:47:08.564508Z","title":"LLMs Don’t Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations2025 2025-09-11","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28677","last_updated":"2026-07-29T07:12:46Z","snapshot_observed_at":"2026-08-09T10:31:26.431396Z","submitted_at":"2026-07-29T07:12:46Z","title":"Reasoning in Real World Clinical Care: Why Large Language Models Are Not Yet Safe for Autonomous Clinical Decision Support","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T00:47:08.564508Z"},"links":{"cited_paper":"/paper/2509.09396","citing_paper":"/paper/2607.28677"},"observation_digest":"sha256:c85be0b90d5e0b30b6c1f94f5759d3930be8bfd1b6e2d375660b5445df3ad321","observation_id":"993d9874-d12c-4727-b5dd-74d99e6f52a2","resolution":{"observed_at":"2026-08-03T00:47:08.564508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.09396/citation-record","integrity":"/paper/2509.09396/integrity","json":"/paper/2509.09396/citation-record.json","paper":"/paper/2509.09396"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.326149Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.326149Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:d34170a0682c72dcf729bc18ad7a2cbfb0ef8ed8e307edb3d06fd903fcc1b5ae","observation_id":"8cda2ce9-1dbb-463a-b157-23ae092d8b03","resolution":{"observed_at":"2026-08-04T19:12:05.326149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.396750Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.396750Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:a99e12791a605793bb343ae247152434e9c0fd430e48af21829bbae8366ff154","observation_id":"aa3a8928-08ce-4123-9475-ddebf9e192f9","resolution":{"observed_at":"2026-08-04T19:12:05.396750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.485458Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.485458Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:60459ca028ab5710605ed05a4335a8966c1efbfe357a49e726aac7f4270d706a","observation_id":"c8ddce84-bfc0-44f7-aaff-a888d8b19edb","resolution":{"observed_at":"2026-08-04T19:12:05.485458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08775","last_updated":"2025-05-13T17:53:59Z","snapshot_observed_at":"2026-07-06T21:23:23.760393Z","submitted_at":"2025-05-13T17:53:59Z","title":"HealthBench: Evaluating Large Language Models Towards Improved Human Health","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08775","snapshot_observed_at":"2026-08-04T19:12:05.564129Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.564129Z"},"links":{"cited_paper":"/paper/2505.08775","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:a45bf8e3d09dffee36fd252a93e2dee8f2858112bd13e5d13dccfc9f2c27a8f5","observation_id":"92360142-da8e-4007-b079-0beb0dac641e","resolution":{"observed_at":"2026-08-04T19:12:05.564129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11926","last_updated":"2025-03-14T23:50:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-14T23:50:34Z","title":"Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11926","snapshot_observed_at":"2026-08-04T19:12:05.648490Z","title":"Guan, Aleksander Madry, Wojciech Zaremba, Jakub Pachocki, and David Farhi","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.648490Z"},"links":{"cited_paper":"/paper/2503.11926","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:9d3d2ae2dae3f42e08d80ede822d84243d340ab739211251890c87069ea495d7","observation_id":"0c8d9652-4789-49f1-9c1d-60e15a4b81b7","resolution":{"observed_at":"2026-08-04T19:12:05.648490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.732485Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.732485Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:921fc350a093500e891a38f7154290378c1f9441310b04fb00ffd7ab46e65d9a","observation_id":"df344732-c605-412b-a353-19372d1bbc28","resolution":{"observed_at":"2026-08-04T19:12:05.732485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05410","last_updated":"2025-05-08T16:51:43Z","snapshot_observed_at":"2026-07-06T21:21:01.070459Z","submitted_at":"2025-05-08T16:51:43Z","title":"Reasoning Models Don't Always Say What They Think","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05410","snapshot_observed_at":"2026-08-04T19:12:05.814286Z","title":"Bowman, Jan Leike, Jared Kaplan, and Ethan Perez","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.814286Z"},"links":{"cited_paper":"/paper/2505.05410","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:8637740c85555706a3cdcf8a97acc8bccaa0d2a07623030ad4e40d9558a84a46","observation_id":"e706203d-4698-45ef-9caf-4a22f187b0d5","resolution":{"observed_at":"2026-08-04T19:12:05.814286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.899425Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.899425Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:b1db49ded421d232f4a477c3974270d73b25fb5f1c548449c530f7ef13a1eeb5","observation_id":"d0263309-8556-4c0d-b52e-9f89c8773360","resolution":{"observed_at":"2026-08-04T19:12:05.899425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:05.981205Z","title":"Cruz, Moritz Hardt, and Celestine Mendler-D\\\" u nner","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:05.981205Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:215f8b7a7617ec5330320c46c01f6eb13d1d6e87045ee6a245c90a4c930ca090","observation_id":"0a98f8f7-5bd3-43f0-a9f4-281c1eaa6607","resolution":{"observed_at":"2026-08-04T19:12:05.981205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.034770Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.034770Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:1baafa65c90094fb9f660089b2286996eb98138019d984d3ae1dca3fccb551fd","observation_id":"2887f73a-4381-4234-9d58-c0ada65a470a","resolution":{"observed_at":"2026-08-04T19:12:06.034770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-04T19:12:06.119620Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.119620Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:c72fd93c141ad5a73e8f4bb54d7ab764b4eb95d14cdb1a8e2fdb0c94008182bf","observation_id":"69c6d3e5-9d6e-48c0-8539-63b203237fbc","resolution":{"observed_at":"2026-08-04T19:12:06.119620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.202531Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.202531Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:d7b9f1bf5db6142c3d04b78a6f55d5f3f9a313c4e3248de131822c4bdb7f99c2","observation_id":"b073688a-8c50-467b-b868-5e3632100198","resolution":{"observed_at":"2026-08-04T19:12:06.202531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.05246","last_updated":"2025-07-07T17:54:52Z","snapshot_observed_at":"2026-08-06T19:26:32.984962Z","submitted_at":"2025-07-07T17:54:52Z","title":"When Chain of Thought is Necessary, Language Models Struggle to Evade Monitors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.05246","snapshot_observed_at":"2026-08-04T19:12:06.259601Z","title":"Elson, Rif A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.259601Z"},"links":{"cited_paper":"/paper/2507.05246","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:4d471e16a0b9bfbb3fdb0cd9fa86eb5cbde0c823245cf50397ed7a779d697fdd","observation_id":"39213e19-e1ce-4129-8578-75e7184c38fb","resolution":{"observed_at":"2026-08-04T19:12:06.259601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-04T19:12:06.338467Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.338467Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:7b0f0c5f4e963bb96f77f5cecd9f5717cad273ae03581c01b1e94b798cb32be6","observation_id":"021500b3-9fc8-474a-a79f-117bb9ee08c1","resolution":{"observed_at":"2026-08-04T19:12:06.338467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.419676Z","title":null,"venue":null,"work_id":null,"year":1971},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.419676Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:39a0ea788ca9562305e94e5f75256451dfbdee81fb64c5d096fa18b20dd0ecdc","observation_id":"e13d22b6-c724-4adb-a8c4-3718eb611193","resolution":{"observed_at":"2026-08-04T19:12:06.419676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-04T19:12:06.477853Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.477853Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:39fcc282d9ab4aae787f83616686f7cae62128b2103fe3d3bc5b680f360227ca","observation_id":"de56119d-eb20-4994-8c3c-5aefd49ba625","resolution":{"observed_at":"2026-08-04T19:12:06.477853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.551684Z","title":null,"venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.551684Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:5fc69b652c6dd0b8457c7bb23ffef7fcbe5a2702438817ba6445481d9d17b42c","observation_id":"803ac19e-f731-4008-8751-b54ab1619c92","resolution":{"observed_at":"2026-08-04T19:12:06.551684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.612237Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.612237Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:fe565bf91d9eb72c9156e5a5298652ad8135db06eadd5144840dc07db9947a13","observation_id":"acbf3200-9fab-44a8-9e6e-6663098f3578","resolution":{"observed_at":"2026-08-04T19:12:06.612237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.720852Z","title":"Gonzalez, Hao Zhang, and Ion Stoica","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.720852Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:a5ee90fb3884f8ae1b4404b2fe8ba63a1ad4d966423155f014b3fea51847b830","observation_id":"77323717-79e0-4a0d-a1f8-7d439add0df7","resolution":{"observed_at":"2026-08-04T19:12:06.720852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-07-31T04:21:27.501709Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-08-04T19:12:06.779090Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.779090Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:884b164985ba96ecf568219e1941981571dadde9039c1a7ddd6296cc15b90e90","observation_id":"f71c4a8c-1ed0-4ddb-8a27-f33b43b5cd27","resolution":{"observed_at":"2026-08-04T19:12:06.779090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.858066Z","title":null,"venue":null,"work_id":null,"year":1973},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.858066Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:8937e046d2b587a2df2eb4d6d3d9529d306d5b44cf91caae0b32efd30cb02371","observation_id":"c9426b7a-3d50-4297-8ac1-81ede99952f1","resolution":{"observed_at":"2026-08-04T19:12:06.858066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.911667Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.911667Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:c2da093b85cb85f1fd4020b0a9feb48695b4c1d80c3a0b43e9514bc94c244d12","observation_id":"17368954-c1b3-4996-8035-c0d409cbe8c5","resolution":{"observed_at":"2026-08-04T19:12:06.911667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:06.976491Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:06.976491Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:a4da1520016b5bf679aa766867a9b9ee977eaae7c54bd369a0f2f9f3f5e09da0","observation_id":"9da75fb8-be89-45a4-85dd-39a7cebfa80e","resolution":{"observed_at":"2026-08-04T19:12:06.976491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.020074Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.020074Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:d0a3b45fee797084e93365c429c2d81cce361bb0d94a027d007d8a4f2cfda1f3","observation_id":"5f94c354-ceab-4c4b-b0ea-c3f446ab3ce6","resolution":{"observed_at":"2026-08-04T19:12:07.020074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05386","last_updated":"2024-11-13T01:40:53Z","snapshot_observed_at":"2026-08-08T17:53:17.777038Z","submitted_at":"2024-05-08T19:31:06Z","title":"Interpretability Needs a New Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.05386","snapshot_observed_at":"2026-08-04T19:12:07.079494Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.079494Z"},"links":{"cited_paper":"/paper/2405.05386","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:358515b88bc9e1ecca6a44b61c0a5502ff0b1d77c6b846f12b02496bbc05d95c","observation_id":"3bde116e-8acc-4e3b-8cb4-b2aab8613b8e","resolution":{"observed_at":"2026-08-04T19:12:07.079494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02643","last_updated":"2024-11-04T22:01:52Z","snapshot_observed_at":"2026-07-06T19:45:13.078526Z","submitted_at":"2024-11-04T22:01:52Z","title":"A Comparative Analysis of Counterfactual Explanation Methods for Text Classifiers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02643","snapshot_observed_at":"2026-08-04T19:12:07.118871Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.118871Z"},"links":{"cited_paper":"/paper/2411.02643","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:0778ca7dfe7e1ae0e1aad8d7a42c355184a08ce8e750f97eb5a0f3ab1dc038bb","observation_id":"2ea2d898-1afb-422e-805b-74b8ab6c1646","resolution":{"observed_at":"2026-08-04T19:12:07.118871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.201820Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.201820Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:bd797966acfad36b8d6c148f58e36ce4ebe53091b8072172c7e048610b7631b0","observation_id":"c6c807c8-02e9-4d93-96d0-fbd8b1185bb5","resolution":{"observed_at":"2026-08-04T19:12:07.201820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.282626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.282626Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:fad02ac417b3632e32500aad55a2914a7f6e33b1795fcde43bcee429fc149e48","observation_id":"888c442d-082c-4fe1-a362-e4e201e7b104","resolution":{"observed_at":"2026-08-04T19:12:07.282626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.365168Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.365168Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:c6c2169fd8fb8a290e50e21d8e766ee36b1c2023ab750c61f0e3308f5600d0f0","observation_id":"7715793f-a691-4f02-95bb-769e7719c0ce","resolution":{"observed_at":"2026-08-04T19:12:07.365168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.419169Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.419169Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:9b74a1c1f314dcb2d813a5291f91a26087d4316fb11bd62219dc666347f8dc71","observation_id":"7c05e287-1a09-4e16-8bca-3f495cbd6a63","resolution":{"observed_at":"2026-08-04T19:12:07.419169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.532455Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.532455Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:9698221d8f339877ab382c2269bb223f761479d46a1483cb4349f05bef065ac6","observation_id":"83c41e56-6950-4d20-bb99-bca339ec6253","resolution":{"observed_at":"2026-08-04T19:12:07.532455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.591950Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.591950Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:0ca1bc83019b5d5f903601ebe205504e73ba052571efd1c63550b44fec06be18","observation_id":"f3bf6fc1-3cdd-4cd4-b3bd-9af4057cef2a","resolution":{"observed_at":"2026-08-04T19:12:07.591950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/1224438","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Taxon","work_id":"c120a268-44ad-4a14-89e0-34e8f462ff72","year":1999},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.673589Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:f2e9688d6c4a246dffa4a926f7e5780b7b6e06882853b43ea13d1530c3c53bf1","observation_id":"9c9d80c3-160d-479c-8db9-c8578e09b581","resolution":{"observed_at":"2026-08-04T19:13:26.198825Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10188","last_updated":"2024-07-23T21:54:12Z","snapshot_observed_at":"2026-07-06T18:46:05.098630Z","submitted_at":"2024-07-14T13:16:23Z","title":"Unexpected Benefits of Self-Modeling in Neural Systems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10188","snapshot_observed_at":"2026-08-04T19:12:07.757757Z","title":"Premakumar, Michael Vaiana, Florin Pop, Judd Rosenblatt, Diogo Schwerz de Lucena, Kirsten Ziman, and Michael S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.757757Z"},"links":{"cited_paper":"/paper/2407.10188","citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:682e9cf8562069ce74785e97ab63978e82fee563bad9e583dce9be8622e4569f","observation_id":"85f7c928-ea1d-4701-8b29-c6f710224705","resolution":{"observed_at":"2026-08-04T19:12:07.757757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.839916Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.839916Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:33e8e8002a5bdd9bf40e84c9dd22c43e13e81734b14431ba2e0159fb282e471a","observation_id":"a9cee5f4-c3e9-4278-aaeb-29cae1beb750","resolution":{"observed_at":"2026-08-04T19:12:07.839916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:07.933512Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:07.933512Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:05b9269d0c249b2cb65a13baa4f117ab2a4629014068d9680d465f6c84f02b98","observation_id":"aae5d02a-73e8-4a96-87fa-0d8bec00128b","resolution":{"observed_at":"2026-08-04T19:12:07.933512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.033880Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.033880Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:08ea1470acef4ee4761a81f31e8567cc2a07ba7b97aae3a1dd25dceb9d8aa3f4","observation_id":"024306a8-eafb-443d-aa18-68c4fb492e8f","resolution":{"observed_at":"2026-08-04T19:12:08.033880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.133210Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.133210Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:82dc8daad98982eac7d56e178c893270920fdb288a738587b972d38fa2f98380","observation_id":"f62777d2-6160-4cc6-b6d5-a5bc44d699de","resolution":{"observed_at":"2026-08-04T19:12:08.133210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.210404Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.210404Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:dd696b96b37e3b2525157be941b77cbe932a60bf1bd28ab3bef762c404d30ef9","observation_id":"4c85d24f-2521-4c90-9d10-7296be21bd2c","resolution":{"observed_at":"2026-08-04T19:12:08.210404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.213265Z","title":"Sara Mahdavi, Christopher Semturs, and 7 others","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.213265Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:417db75b50f6047f5838fe7a8eb26efbfa0a89bd4d62248e9407ceac95d2a752","observation_id":"94777b90-7913-4db0-8817-55cde4bb6905","resolution":{"observed_at":"2026-08-04T19:12:08.213265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.274966Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.274966Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:ed6ed289801c59956a765cc9fdf6d234cf038bcaa74855110077973853c87e58","observation_id":"2b6df944-c392-4895-ab82-2dd886f4f4bc","resolution":{"observed_at":"2026-08-04T19:12:08.274966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.383046Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.383046Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:60271ec60712c34240f414840ed8dab3f07bbec4fabe23de07933412ad0b0885","observation_id":"33d2796b-e370-4d5d-85f8-e5ca11c52885","resolution":{"observed_at":"2026-08-04T19:12:08.383046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.498169Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.498169Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:a8ef0a1f5a3b8997d254d5dc74d0506199c490dc7e83c12488e0fc362baeaa66","observation_id":"5818337c-4b15-48f9-8cbc-344fdc97dbc1","resolution":{"observed_at":"2026-08-04T19:12:08.498169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.601054Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.601054Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:ce959d5b584277d21387036f337582e54a4889e10e25109c0ab9656385403274","observation_id":"27f16379-0b10-4bcd-be56-7834f07f5676","resolution":{"observed_at":"2026-08-04T19:12:08.601054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.715022Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.715022Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:015bc76bef228eefa92204b3f3055b89a4ce952a04d64c65f6973c57e7a886ba","observation_id":"371c4c60-a1df-4233-aed0-23db6c2333ec","resolution":{"observed_at":"2026-08-04T19:12:08.715022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.841648Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.841648Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:cd4ce3cad25f590f776ceb4225f86701c59468da420ab6d56a2b799b061bda9e","observation_id":"0e2ed8a1-565b-4dc8-b25c-9c1d4edf28e2","resolution":{"observed_at":"2026-08-04T19:12:08.841648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:12:08.926105Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-04T19:12:08.926105Z"},"links":{"citing_paper":"/paper/2509.09396"},"observation_digest":"sha256:7fb04c77a32242139e0992f657535efb7c987f718ae99b61c1bff0ab428d6ab7","observation_id":"1247807c-82d0-41a9-8f1a-c2843c78c22b","resolution":{"observed_at":"2026-08-04T19:12:08.926105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09396","last_updated":"2025-09-11T12:25:41Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T11:34:45.899331Z","submitted_at":"2025-09-11T12:25:41Z","title":"LLMs Don't Know Their Own Decision Boundaries: The Unreliability of Self-Generated Counterfactual Explanations"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2509.09396."}