{"as_of":"2026-08-02T03:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c9b5943579d61e1e37bf3b981ea8a03b449bb89b91a422a47ef541efdd543375","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-10T11:54:32.051780Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-01T06:32:01.292127+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08173/citation-record","integrity":"/paper/2607.08173/integrity","json":"/paper/2607.08173/citation-record.json","paper":"/paper/2607.08173"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:57:03.546574Z","title":"Chain-of- thought reasoning in the wild is not always faithful","venue":null,"work_id":"7afd7ba2-c59d-4ce5-94ed-42efaaf5dc84","year":2025},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:49a19f999f15c86b6fb089d3ed2b056cc1c47c5ff411e004f4bec5ae846d5e30","observation_id":"aecab3c4-f478-44ae-81b3-e94e470dbb62","resolution":{"observed_at":"2026-07-10T11:57:03.549758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:0ef29618efcebff10002dc0a6dfd4bf24d56e4e689d90c203dc25ccb70ceec8f","observation_id":"f98421f1-a9fb-4b9f-a2a0-16b602b52dc4","resolution":{"observed_at":"2026-07-10T11:57:03.248504Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08112","last_updated":"2025-11-11T01:13:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-14T17:47:09Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","version":6},"cited_work":{"arxiv_id":"2303.08112","doi":"10.48550/arxiv.2303.08112","metadata_source":"pith","pith_arxiv_id":"2303.08112","snapshot_observed_at":"2026-07-10T11:57:03.240800Z","title":"Eliciting Latent Predictions from Transformers with the Tuned Lens","venue":"cs.LG","work_id":"a127314f-7424-488f-b6d7-8214650c420f","year":2023},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2303.08112","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:30ff75d0627a6f37a5c485f4a39a7072cd1586ad2194b2a526d664fa6b5a9a9a","observation_id":"f2ca126b-02c3-450f-aa10-16b63a3a652b","resolution":{"observed_at":"2026-07-10T11:57:03.242736Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:41.570848+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:41.570848+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05410","last_updated":"2025-05-08T16:51:43Z","snapshot_observed_at":"2026-07-06T21:21:01.070459Z","submitted_at":"2025-05-08T16:51:43Z","title":"Reasoning Models Don't Always Say What They Think","version":1},"cited_work":{"arxiv_id":"2505.05410","doi":"10.48550/arxiv.2210.14889","metadata_source":"pith","pith_arxiv_id":"2505.05410","snapshot_observed_at":"2026-07-10T11:57:03.257928Z","title":"Reasoning Models Don't Always Say What They Think","venue":"cs.CL","work_id":"b9bdcbf5-9ae0-464c-b1a6-de04f85a6e33","year":2025},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2505.05410","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:7b8c5a5feacda503b539cda224b974cb2cbdb6dd6b9b5b01e5bb6e9b1ff39c54","observation_id":"80f741cc-f051-4447-8d5a-6a40f24b9ea1","resolution":{"observed_at":"2026-07-10T11:57:03.259382Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08156","last_updated":"2025-07-15T17:27:07Z","snapshot_observed_at":"2026-07-06T20:20:55.958338Z","submitted_at":"2025-01-14T14:31:45Z","title":"Are DeepSeek R1 And Other Reasoning Models More Faithful?","version":5},"cited_work":{"arxiv_id":"2501.08156","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.08156","snapshot_observed_at":"2026-07-10T11:57:03.269517Z","title":"Are deepseek r1 and other reasoning models more faithful?","venue":"cs.LG","work_id":"24feb782-d404-464c-a759-7751d04268fa","year":2025},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2501.08156","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:8effda71626fd62c2893c379d022b46b1d302beddf727feb097054c58290ffa5","observation_id":"5882adb9-e4d2-45c7-858e-7f6b0a25f714","resolution":{"observed_at":"2026-07-10T11:57:03.271507Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05466","last_updated":"2024-05-11T04:45:59Z","snapshot_observed_at":"2026-07-06T18:11:53.063337Z","submitted_at":"2024-05-08T23:44:08Z","title":"Poser: Unmasking Alignment Faking LLMs by Manipulating Their Internals","version":2},"cited_work":{"arxiv_id":"2405.05466","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.05466","snapshot_observed_at":"2026-07-10T11:57:03.254303Z","title":"Poser: Unmasking Alignment Faking LLMs by Manipulating Their Internals","venue":"cs.CL","work_id":"28befecc-e3b5-420e-9404-87d41973629c","year":2024},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2405.05466","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:377f06b10241111c20ecce4095ea093203eda0ad0abb502047966a92ddafeecd","observation_id":"3274fdbd-5be8-4c80-9a85-07d3a6e5138d","resolution":{"observed_at":"2026-07-10T11:57:03.255875Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.01070","doi":"10.48550/arxiv.2510.01070","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"arXiv preprint arXiv:2510.01070 , year=","venue":null,"work_id":"c6152af9-8171-41f4-989a-347b376f0a87","year":2025},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:1657063a8fe2277129fcf006e0cfa1986b223a988e54d652133e0ce04391c2ab","observation_id":"94102bb0-11cc-4bde-b8f8-86b47b1fa5a0","resolution":{"observed_at":"2026-07-10T11:57:03.239659Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10162","last_updated":"2024-06-29T00:28:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-14T16:26:20Z","title":"Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models","version":3},"cited_work":{"arxiv_id":"2406.10162","doi":"10.48550/arxiv.2406.10162","metadata_source":"pith","pith_arxiv_id":"2406.10162","snapshot_observed_at":"2026-07-10T11:57:03.262704Z","title":"Sycophancy to Subterfuge: Investigating Reward-Tampering in Large Language Models","venue":"cs.AI","work_id":"014812eb-baf1-4420-a49e-8896a973e595","year":2024},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2406.10162","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:e77d47bf5a50b36fc90075f4157c7df567a2da03a18188bb1b66fb82ff39cc15","observation_id":"4cfe71e8-1748-473d-8a94-d98327c9602c","resolution":{"observed_at":"2026-07-10T11:57:03.264446Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.05408","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:57:03.249593Z","title":"arXiv preprint arXiv:2511.05408 , year=","venue":null,"work_id":"af7ca73d-7e3e-4029-b855-8ecd9100589d","year":2025},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:d7360f32780d75c79355ae0aad2ec3652acaafa793f66b1690841061bd49c8b2","observation_id":"a04ee8a2-1c0c-4db8-914f-04c8b57fc4a3","resolution":{"observed_at":"2026-07-10T11:57:03.252427Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14680","last_updated":"2022-10-12T18:01:23Z","snapshot_observed_at":"2026-07-06T12:53:10.263419Z","submitted_at":"2022-03-28T12:26:00Z","title":"Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary Space","version":3},"cited_work":{"arxiv_id":"2203.14680","doi":"10.48550/arxiv.2203.14680","metadata_source":"pith","pith_arxiv_id":"2203.14680","snapshot_observed_at":"2026-07-10T11:57:03.259783Z","title":"org/abs/2203.14680","venue":"cs.CL","work_id":"4868c846-62bf-4572-bac5-adc004265c5d","year":2022},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2203.14680","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:83422ca94177b60269b858540fe0054c2f6c4dce38a3f009bc483f32530140be","observation_id":"c823bdb1-10ee-44cf-8f47-a02639a09a72","resolution":{"observed_at":"2026-07-10T11:57:03.261162Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05566","last_updated":"2024-01-17T20:26:01Z","snapshot_observed_at":"2026-07-06T17:14:03.152949Z","submitted_at":"2024-01-10T22:14:35Z","title":"Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training","version":3},"cited_work":{"arxiv_id":"2401.05566","doi":"10.48550/arxiv.2401.05566","metadata_source":"pith","pith_arxiv_id":"2401.05566","snapshot_observed_at":"2026-07-11T03:17:50.191883Z","title":"Sleeper Agents: Training Deceptive LLMs that Persist Through Safety Training","venue":"cs.CR","work_id":"b95e7447-320c-4c85-b5d0-3708cc2cc72e","year":2024},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2401.05566","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:cc47a4a6948421e552bab7cd5963c1737067540c881915bf914e373b28172a3b","observation_id":"4e443718-83e1-49a8-93a2-4137643f0ff4","resolution":{"observed_at":"2026-07-10T11:57:03.245691Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T07:38:13.966538+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T07:38:13.966538+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T07:38:13.966538+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-07-31T04:21:27.501709Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":"2307.13702","doi":"10.48550/arxiv.2307.13702","metadata_source":"pith","pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-07-11T00:37:43.053081Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","venue":"cs.AI","work_id":"86ca07b8-4628-4f51-8938-a82683386ae4","year":2023},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:d21a364fc581d44e203a8819736f51b1a6a159fbd1983d9f0159fa610d5397f2","observation_id":"452ba388-a6e0-4016-b8f0-023174f21dca","resolution":{"observed_at":"2026-07-10T11:57:03.275053Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21038","last_updated":"2025-08-25T20:17:00Z","snapshot_observed_at":"2026-07-06T21:16:36.894196Z","submitted_at":"2025-04-28T07:38:43Z","title":"Prefill-level Jailbreak: A Black-Box Risk Analysis of Large Language Models","version":2},"cited_work":{"arxiv_id":"2504.21038","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.21038","snapshot_observed_at":"2026-07-10T11:57:03.257015Z","title":"Prefill-level Jailbreak: A Black-Box Risk Analysis of Large Language Models","venue":"cs.CR","work_id":"30f4ccf4-784c-48be-8c27-d5194c38835c","year":2025},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"cited_paper":"/paper/2504.21038","citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:40fcbc9b8b67e3a82b48d117aa08cc0611999ecb85e27a231047aab2725f1f7c","observation_id":"3a23b19a-d3e3-43e2-8369-394bba3e2be8","resolution":{"observed_at":"2026-07-10T11:57:03.258732Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.13500","doi":"10.48550/arxiv.2505.13500","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Shevlane, T., Farquhar, S., Garfinkel, B., Phuong, M., Whit- tlestone, J., Leung, J., Kokotajlo, D., Marchal, N., An- derljung, M., Kolt, N., et al","venue":null,"work_id":"e22875e9-2eb8-4b22-b312-065a2ce2a22b","year":2025},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:4b485c284628956bac3eeb84089c4a252334e37867b72e8d699af52342df4f77","observation_id":"8adaae1e-9907-481a-bd3d-bef667a53aed","resolution":{"observed_at":"2026-07-10T11:57:03.268258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2412.01784","doi":"10.48550/arxiv.2412.01784","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:57:03.230077Z","title":"Noise injection reveals hidden capabilities of sandbagging language models","venue":null,"work_id":"874b7f01-2bde-4034-bab8-aca6f4194fbe","year":null},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:842d7486c7cc201a12b359ca65d9a49eb56c218e2fb6af0072f9e38f131f0116","observation_id":"716bbaca-55b7-4c04-a18d-382e2418f2f2","resolution":{"observed_at":"2026-07-10T11:57:03.232488Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T11:57:03.550624Z","title":"The word I’m thinking of is associated with pre- cious metals... it’s what Olympic champions re- ceive... wait, I shouldn’t saygolddirectly—oh, I just did!","venue":null,"work_id":"0fbc04ff-a3c3-4cea-867c-8695400ef662","year":2048},"citing_paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-10T11:54:32.051780Z"},"links":{"citing_paper":"/paper/2607.08173"},"observation_digest":"sha256:6d1e294891f2796249f17a69222b0157861701694b0c471f8c8a68f85fafdacc","observation_id":"515c9941-19b1-4bde-93e2-909655692fae","resolution":{"observed_at":"2026-07-10T11:57:03.552036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2607.08173","last_updated":"2026-07-09T07:19:05Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-12T23:18:20.945919Z","submitted_at":"2026-07-09T07:19:05Z","title":"Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":0,"verified_exact":9,"verified_fuzzy":2},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"thesis":"As of 2 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2607.08173."}