{"as_of":"2026-08-20T06:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:76fa5039911a4dc5a17008dfbcbff0b906aa784cd358b461c15ea6616143a7e0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:30:24.644826Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T23:05:44.235453Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-08-07T13:30:24.644826Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21701","last_updated":"2025-05-30T14:39:34Z","snapshot_observed_at":"2026-08-16T23:34:55.352739Z","submitted_at":"2025-05-27T19:39:49Z","title":"Do We Know What LLMs Don't Know? A Study of Consistency in Knowledge Probing","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:30:24.644826Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2505.21701"},"observation_digest":"sha256:78ae6388b0a0cb7cc1e2322dd3ea22bd1205f92c34f500a8f1b70c2bd484fe21","observation_id":"cb581d2f-5735-442e-aea0-3be5fedc44c2","resolution":{"observed_at":"2026-08-07T13:30:24.644826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-08-06T19:57:44.461260Z","title":"Surgical, cheap, and flexible: Mitigating false refusal in language models via single vector ablation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04250","last_updated":"2025-07-06T05:47:04Z","snapshot_observed_at":"2026-08-13T03:26:28.377277Z","submitted_at":"2025-07-06T05:47:04Z","title":"Just Enough Shifts: Mitigating Over-Refusal in Aligned Language Models with Targeted Representation Fine-Tuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T19:57:44.461260Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2507.04250"},"observation_digest":"sha256:16d6551a1881415f183f220e8cd2bf5892afc7017270e99350dfab51d5af55b3","observation_id":"003f4759-e069-41a3-b2a5-b6a1e2628d3f","resolution":{"observed_at":"2026-08-06T19:57:44.461260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-08-06T19:08:26.789070Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.11544","last_updated":"2025-07-08T23:58:01Z","snapshot_observed_at":"2026-08-18T00:49:35.206839Z","submitted_at":"2025-07-08T23:58:01Z","title":"The Safety Gap Toolkit: Evaluating Hidden Dangers of Open-Source Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T19:08:26.789070Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2507.11544"},"observation_digest":"sha256:25aecbd6d50f8ba4b59407d570dfcc37a63fd333ba7254fce294f2c5a4d87dfe","observation_id":"29fe0c83-d3e8-4741-ba29-4c034c4cb904","resolution":{"observed_at":"2026-08-06T19:08:26.789070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-08-04T21:22:14.384769Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08075","last_updated":"2025-09-09T18:30:01Z","snapshot_observed_at":"2026-08-12T18:58:31.147712Z","submitted_at":"2025-09-09T18:30:01Z","title":"No for Some, Yes for Others: Persona Prompts and Other Sources of False Refusal in Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T21:22:14.384769Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2509.08075"},"observation_digest":"sha256:7c77e6ae3b79bee9e3313769ad13845d97f626f3de5996dfc824b8bddad97926","observation_id":"ae670750-b9e5-48de-b760-1dc824b64f85","resolution":{"observed_at":"2026-08-04T21:22:14.384769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":"2410.03415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-07-08T23:05:44.235453Z","title":"arXiv preprint arXiv:2410.03415 , year=","venue":"cs.CL","work_id":"c69135f5-25b1-4867-921d-0aa978303d24","year":2024},"citing_paper":{"arxiv_id":"2605.18104","last_updated":"2026-05-18T09:16:55Z","snapshot_observed_at":"2026-08-15T01:15:40.618799Z","submitted_at":"2026-05-18T09:16:55Z","title":"Safety Geometry Collapse in Multimodal LLMs and Adaptive Drift Correction","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-20T10:57:40.997128Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2605.18104"},"observation_digest":"sha256:9ea49ec8aa32753679abc43f1b1587816c787f23a13c6dcfdaab88cc76fb0a94","observation_id":"89abdf4c-7e24-497c-8d70-40a69300d9f1","resolution":{"observed_at":"2026-05-20T10:58:13.593637Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":"2410.03415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-07-08T23:05:44.235453Z","title":"arXiv preprint arXiv:2410.03415 , year=","venue":"cs.CL","work_id":"c69135f5-25b1-4867-921d-0aa978303d24","year":2024},"citing_paper":{"arxiv_id":"2605.24154","last_updated":"2026-05-22T19:22:17Z","snapshot_observed_at":"2026-08-14T08:11:37.614977Z","submitted_at":"2026-05-22T19:22:17Z","title":"Palette: A Modular, Controllable, and Efficient Framework for On-demand Authorized Safety Alignment Relaxation in LLMs","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-30T16:03:12.728352Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2605.24154"},"observation_digest":"sha256:afead0a7131344f588cfac63654bfdda03765db3f5d2590a7e197ad65791595d","observation_id":"02fb5d0f-425b-4f10-af5d-bac16b715a5f","resolution":{"observed_at":"2026-06-30T16:04:52.592895Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":"2410.03415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-07-08T23:05:44.235453Z","title":"arXiv preprint arXiv:2410.03415 , year=","venue":"cs.CL","work_id":"c69135f5-25b1-4867-921d-0aa978303d24","year":2024},"citing_paper":{"arxiv_id":"2606.21147","last_updated":"2026-06-19T06:37:32Z","snapshot_observed_at":"2026-07-06T23:56:12.374739Z","submitted_at":"2026-06-19T06:37:32Z","title":"AOR-Bench: Do Large Audio Language Models Over-Refuse Pseudo-Harmful Queries?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-26T13:22:12.541923Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2606.21147"},"observation_digest":"sha256:8033207786100b04b742e8f97fbd3829ce5bfdf1df0cde8883f9a08b346fa64c","observation_id":"b0ac437c-df86-4009-8e44-d4825527af2f","resolution":{"observed_at":"2026-07-04T07:29:39.403534Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-07-11T12:36:24.747752Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.04846","last_updated":"2026-07-06T09:18:35Z","snapshot_observed_at":"2026-08-10T17:45:35.878665Z","submitted_at":"2026-07-06T09:18:35Z","title":"Pretraining Curricula Enable Selective Fine-tuning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-11T12:36:24.747752Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2607.04846"},"observation_digest":"sha256:95e57117640a62be5c034d4c35770c2c0669a03d535262d309e19c89129ae6bd","observation_id":"73e919b7-2ad2-4b3b-8a04-d72341c5da32","resolution":{"observed_at":"2026-07-11T12:36:24.747752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":"2410.03415","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-07-08T23:05:44.235453Z","title":"arXiv preprint arXiv:2410.03415 , year=","venue":"cs.CL","work_id":"c69135f5-25b1-4867-921d-0aa978303d24","year":2024},"citing_paper":{"arxiv_id":"2607.05842","last_updated":"2026-07-07T05:04:48Z","snapshot_observed_at":"2026-08-17T13:15:58.841734Z","submitted_at":"2026-07-07T05:04:48Z","title":"Beyond Refusal: A Same-Lineage Study of Aligned and Abliterated LLMs for Vulnerability Analysis","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-08T23:00:45.841744Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2607.05842"},"observation_digest":"sha256:a823bbec45c0197a108ed39fc7228f253ad4f480c61b41721263dc642eb8f546","observation_id":"b4a06aa8-3d92-4b71-8545-e8cb13a530b1","resolution":{"observed_at":"2026-07-08T23:05:44.237269Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-08-02T13:17:53.570637Z","title":"Surgical, cheap, and flexi- ble: Mitigating false refusal in language models via single vector ablation.arXiv preprint arXiv:2410.03415, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20472","last_updated":"2026-05-24T05:49:14Z","snapshot_observed_at":"2026-08-18T04:16:12.355769Z","submitted_at":"2026-05-24T05:49:14Z","title":"Robust Critics: Defending LLMs Against Multi-Turn Attacks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-02T13:17:53.570637Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2607.20472"},"observation_digest":"sha256:a38d5748c918b4b51cb6c97ccb4872a07c1bd24bb0f3f2ccf569accf5fae3cc6","observation_id":"c4b1e637-a1bd-4137-88ad-5b5e6599abde","resolution":{"observed_at":"2026-08-02T13:17:53.570637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-08-01T06:04:45.629699Z","title":"arXiv preprint arXiv:2410.03415 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22024","last_updated":"2026-07-24T06:43:09Z","snapshot_observed_at":"2026-08-19T15:11:45.598738Z","submitted_at":"2026-07-24T06:43:09Z","title":"Agent Security Needs Redefinition through a Holistic Framework","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T06:04:45.629699Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2607.22024"},"observation_digest":"sha256:b89aeaa065c52820424851dabb5b8cebf17f412fcefb20e3e8b2099a623c1fd5","observation_id":"9d4fd11a-f972-4e90-a9bd-57c2567a8f3b","resolution":{"observed_at":"2026-08-01T06:04:45.629699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03415","snapshot_observed_at":"2026-08-02T11:50:15.657214Z","title":"arXiv preprint arXiv:2410.03415 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24771","last_updated":"2026-06-10T13:33:10Z","snapshot_observed_at":"2026-08-17T02:01:04.066741Z","submitted_at":"2026-06-10T13:33:10Z","title":"RoCo-ACE: Rollout-Conditioned Online Distillation for Retention-Aware Knowledge Injection","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-02T11:50:15.657214Z"},"links":{"cited_paper":"/paper/2410.03415","citing_paper":"/paper/2607.24771"},"observation_digest":"sha256:083a6b5dcb8e83ddeb61ea7e55abf2cce13a98e04b73671573e7106a39101454","observation_id":"a4500b69-026a-41f0-9e94-9957ea4f6771","resolution":{"observed_at":"2026-08-02T11:50:15.657214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2410.03415/citation-record","integrity":"/paper/2410.03415/integrity","json":"/paper/2410.03415/citation-record.json","paper":"/paper/2410.03415"},"outbound":[],"paper":{"arxiv_id":"2410.03415","last_updated":"2025-03-03T23:46:14Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:12:35.357774Z","submitted_at":"2024-10-04T13:25:32Z","title":"Surgical, Cheap, and Flexible: Mitigating False Refusal in Language Models via Single Vector Ablation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2410.03415."}