{"as_of":"2026-08-07T10:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:32c8f3a1de36060078aa37069346420f726440b066528306a4221e235c015075","coverage":[{"denominator":139,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T11:49:47.994456Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T21:16:55.878954Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-19T21:17:48.408119Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"cited_work":{"arxiv_id":"2605.05678","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.05678","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","venue":"cs.AI","work_id":"642ddea3-1a4e-4e44-88a4-40ace6cdd0eb","year":2026},"citing_paper":{"arxiv_id":"2605.16594","last_updated":"2026-05-15T19:57:17Z","snapshot_observed_at":"2026-07-06T23:27:43.762904Z","submitted_at":"2026-05-15T19:57:17Z","title":"fPINN-DeepONet: A Physics-Informed Operator Learning Framework for Multi-term Time-fractional Mixed Diffusion-wave Equations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T21:16:55.878954Z"},"links":{"cited_paper":"/paper/2605.05678","citing_paper":"/paper/2605.16594"},"observation_digest":"sha256:1d7e6aaa7f8d9297cdab1d0c99a1b5d22215814a2555d5ad671df69bd81dc8f1","observation_id":"fb0ffa59-1835-41e8-855c-6106517178c5","resolution":{"observed_at":"2026-05-19T21:17:48.411903Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.05678/citation-record","integrity":"/paper/2605.05678/integrity","json":"/paper/2605.05678/citation-record.json","paper":"/paper/2605.05678"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Chawla, Jian Pei, Jianfeng Gao, Michael Backes, Philip S","venue":null,"work_id":"de20f0bd-06a2-48d0-be96-eef4bd988e2d","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:647126877264b01e8a65fa7fe78018eaef32527f4d05b951d8bc6cd941e46d08","observation_id":"9a08ec63-8e4b-4be5-badd-ee1a9cb776b8","resolution":{"observed_at":"2026-05-26T13:57:25.873265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Outcome first or overview first? optimizing patient-oriented framework for evidence-based healthcare treatment selections with xai tools","venue":null,"work_id":"b3f0ba63-ece0-4eb2-8fef-2187c124f086","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:3db6965884ae508b01740686f5c3f5c2ea2fd4abf62fefbf523669dd82031a0c","observation_id":"754eb586-c2be-4416-99cc-981f89a7e069","resolution":{"observed_at":"2026-05-26T13:57:25.893005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Semantic volume: Quantifying and detecting both ex- ternal and internal uncertainty in llms","venue":null,"work_id":"426e2730-9668-412e-b3f3-0196b3c05e5d","year":2026},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:3ccc0ed7021ccfeedd0237e37429b9bd0e5aead2903ba796701b7f0eae41fee8","observation_id":"8661ccde-24bf-4443-af1c-878f8bed0c58","resolution":{"observed_at":"2026-05-26T13:57:25.928672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24040","last_updated":"2025-05-29T22:23:48Z","snapshot_observed_at":"2026-07-06T21:33:17.306281Z","submitted_at":"2025-05-29T22:23:48Z","title":"MedPAIR: Measuring Physicians and AI Relevance Alignment in Medical Question Answering","version":1},"cited_work":{"arxiv_id":"2505.24040","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24040","snapshot_observed_at":"2026-07-04T04:19:34.994254Z","title":"Medpair: Measuring physicians and ai relevance alignment in medical question answering","venue":null,"work_id":"0581f534-69c6-4b0b-a662-373d3e2bd50e","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2505.24040","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:027938d4f36d8edf261ee281fcf3cb76faa8c3734fc1f03df4b4bf09104290bf","observation_id":"754b740e-9581-46b2-9fe4-fbb513d5b8b2","resolution":{"observed_at":"2026-05-11T19:31:08.604352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17163","last_updated":"2025-06-20T17:09:27Z","snapshot_observed_at":"2026-08-06T23:28:34.835633Z","submitted_at":"2025-06-20T17:09:27Z","title":"The MedPerturb Dataset: What Non-Content Perturbations Reveal About Human and Clinical LLM Decision Making","version":1},"cited_work":{"arxiv_id":"2506.17163","doi":"10.48550/arxiv.2506.17163","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17163","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The medperturb dataset: What non-content perturbations reveal about human and clinical llm decision making","venue":"ArXiv.org","work_id":"57c582d1-c970-472f-8e5e-7d68b7d766a6","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2506.17163","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:e0a472290a64f97d15df315e5dd13df1f034ca7027761756feca6f5a1aa1c64f","observation_id":"17c60d7f-00ef-42b6-be75-24438d6c3d87","resolution":{"observed_at":"2026-05-11T19:31:08.549200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16339","last_updated":"2025-01-08T20:11:59Z","snapshot_observed_at":"2026-07-06T20:11:15.503499Z","submitted_at":"2024-12-20T21:00:11Z","title":"Deliberative Alignment: Reasoning Enables Safer Language Models","version":2},"cited_work":{"arxiv_id":"2412.16339","doi":"10.48550/arxiv.2412.16339","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.16339","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Y ., Joglekar, M., Wallace, E., Jain, S., Barak, B., Heylar, A., Dias, R., Vallone, A., Ren, H., Wei, J., et al","venue":"arXiv (Cornell University)","work_id":"900d0032-4aa1-4b47-ab57-616164d48b88","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2412.16339","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:8975f04d2b22905e92e93f404ab7b28b6b6a24d15279b235806f55ba69e8557f","observation_id":"35d8e2ed-d827-4192-9da9-8eaedc0b0e00","resolution":{"observed_at":"2026-05-11T19:31:08.576351Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-15T18:20:37.325806+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T18:20:37.325806+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ruleadapter: Dynamic rules for training safety reward models in rlhf","venue":null,"work_id":"dbc251b5-115b-45ee-ab88-035eb76d4f19","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:31f151a130f31ad34c26f1489d03b7badaa76257a1b68f20f808c86e86cf610c","observation_id":"939e0fb5-bf41-455c-9d2c-cb155c8a25ba","resolution":{"observed_at":"2026-05-26T13:57:25.967029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Encore: Entropy-guided reward composition for multi-head safety reward models","venue":null,"work_id":"1fed0301-71db-4a8d-b044-3e7f1144c55f","year":2026},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:1ecb92439d1a2769a0eb265c4bf7aa4ffa1a063e60578a48dd25d353834f8e32","observation_id":"bbb69960-55f6-4435-a866-7b4e35a148a3","resolution":{"observed_at":"2026-05-26T13:57:25.844221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bradley-terry and multi-objective reward modeling are complementary","venue":null,"work_id":"0540a24b-b9bd-4980-b96e-d64989542c56","year":2026},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:f4ab930c466242acfe5cbe02628ad47ce38586d40c714fe12257bc30946b3d57","observation_id":"dfbdb1bd-5582-4e98-ae55-0b1e0b67769c","resolution":{"observed_at":"2026-05-26T13:57:25.840953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16454","last_updated":"2025-03-21T06:37:37Z","snapshot_observed_at":"2026-07-06T19:37:24.895623Z","submitted_at":"2024-10-21T19:28:37Z","title":"Catastrophic Failure of LLM Unlearning via Quantization","version":3},"cited_work":{"arxiv_id":"2410.16454","doi":"10.48550/arxiv.2410.16454","metadata_source":"arxiv_reference","pith_arxiv_id":"2410.16454","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2410.16454 , year=","venue":"arXiv (Cornell University)","work_id":"cd4ea144-7515-47b5-8e50-74159a3d01ee","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2410.16454","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:b3edb95d0ae94579cf248751de0b1c559ceab841cd872c0aabc45f657d4ddc49","observation_id":"44012f56-cebb-4540-bfc5-2898c3b09e46","resolution":{"observed_at":"2026-05-11T19:31:08.599343Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09224","last_updated":"2025-08-12T00:18:23Z","snapshot_observed_at":"2026-08-05T21:35:27.143790Z","submitted_at":"2025-08-12T00:18:23Z","title":"From Hard Refusals to Safe-Completions: Toward Output-Centric Safety Training","version":1},"cited_work":{"arxiv_id":"2508.09224","doi":"10.48550/arxiv.2508.09224","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09224","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"From hard refusals to safe-completions: Toward output-centric safety training","venue":"arXiv (Cornell University)","work_id":"507d58a0-9361-4322-a794-1b7c83696417","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2508.09224","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:7cb2dbbfcabe36dfd4ac362038041f6b27947830851c9f73916c64a2c79d0a36","observation_id":"aec6227f-8076-41dc-94a9-9d0babd9efd4","resolution":{"observed_at":"2026-05-11T19:31:08.563625Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Jailbroken: How does llm safety training fail?Advances in neural information processing systems, 36:80079–80110","venue":null,"work_id":"5b7efa67-9a2b-49c0-8d30-9917ac0d34d9","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:28a46c65653205337f3b0ebbf95e845c15b2c4f2aaf2b33f83ee3229968ff6ed","observation_id":"bfa07cdc-8726-435d-8930-52d7fad8f2ca","resolution":{"observed_at":"2026-05-26T13:57:25.863340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":"2307.15043","doi":"10.48550/arxiv.2307.15043","metadata_source":"pith","pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":"cs.CL","work_id":"3322fa86-1768-4677-8425-dd326b45e078","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:c05b695a6c72a4630c504503a70efa41ff746883c127809df481e7968c68a9e1","observation_id":"1f24bee5-8f5e-4ca8-b663-f516e49ed397","resolution":{"observed_at":"2026-05-11T19:31:08.586144Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T23:50:40.271168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":"2402.04249","doi":"10.48550/arxiv.2402.04249","metadata_source":"pith","pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","venue":"cs.LG","work_id":"b0b0303f-2444-4789-a979-8153624312ff","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:c706dd10b8b47fdf0bbed85c3b8451dd92392ef570057f18115954a00eeb3e7c","observation_id":"fb9f2abc-2a70-40b7-aa3d-ccef70cb721b","resolution":{"observed_at":"2026-05-11T19:31:08.530592Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:45:00.491863Z","title":"A strongreject for empty jailbreaks.Advances in Neural Information Processing Systems, 37:125416–125440","venue":null,"work_id":"86a3a82a-c3df-4026-afd5-dd283a94a9a2","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:cf71dfd246cbd49df16be58e0d857c6f04c55803590236d8fe30032507e3260e","observation_id":"3a49642e-3172-445f-a777-513dd286841d","resolution":{"observed_at":"2026-05-26T13:57:26.174500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T09:02:13.076112Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models.Advances in Neural Information Processing Systems, 37:55005–55029","venue":null,"work_id":"87ae36fa-ba5c-4dfd-a95e-accac5d455b1","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:33eeb0418f487deaa37b82c8d039e38b09ced00c14751c9a6a92cb73319a9180","observation_id":"08da4bce-8845-4017-ab16-e62948ef9a8f","resolution":{"observed_at":"2026-05-26T13:57:25.970527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08370","last_updated":"2024-02-16T09:42:19Z","snapshot_observed_at":"2026-08-07T06:51:25.278756Z","submitted_at":"2023-11-14T18:33:43Z","title":"SimpleSafetyTests: a Test Suite for Identifying Critical Safety Risks in Large Language Models","version":2},"cited_work":{"arxiv_id":"2311.08370","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.08370","snapshot_observed_at":"2026-07-04T03:59:32.652255Z","title":"arXiv preprint arXiv:2311.08370 , year=","venue":null,"work_id":"640cffcd-ef2c-4e9c-9585-872794809e9e","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2311.08370","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:df4994f2c1093d1be36122777ae64db2b64c6eaaec7732e22979325166060937","observation_id":"9ea79794-54cc-4934-974d-0f9707be9d06","resolution":{"observed_at":"2026-05-11T19:31:08.476793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T16:36:22.392023Z","title":"Salad-bench: A hierarchical and comprehensive safety benchmark for large language models","venue":null,"work_id":"a5570357-e823-420a-9573-08863f8fc752","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:728f7ce3fb3282da4491ad403823f13d52bdc4d0470945127c9fbe2e054ef3dd","observation_id":"00c4dbc1-f8ab-4aa7-91ad-21284ed004b9","resolution":{"observed_at":"2026-05-26T13:57:26.105558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11413","last_updated":"2025-05-16T16:25:51Z","snapshot_observed_at":"2026-07-06T21:25:08.411184Z","submitted_at":"2025-05-16T16:25:51Z","title":"CARES: Comprehensive Evaluation of Safety and Adversarial Robustness in Medical LLMs","version":1},"cited_work":{"arxiv_id":"2505.11413","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.11413","snapshot_observed_at":"2026-07-10T18:57:31.603078Z","title":"Wenhu Chen et al","venue":"cs.CL","work_id":"cb8e4ad0-d739-4338-a07b-a6783cb1c115","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2505.11413","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:f55225166de51537bff11ed6b7236830473128480a57e2cb4c69f151277beb50","observation_id":"707080c9-2322-4816-b73f-bdbae1efb281","resolution":{"observed_at":"2026-05-11T19:31:08.515427Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.11423","last_updated":"2025-09-02T02:55:17Z","snapshot_observed_at":"2026-07-06T21:25:08.411184Z","submitted_at":"2025-05-16T16:36:00Z","title":"When Thinking Fails: The Pitfalls of Reasoning for Instruction-Following in LLMs","version":3},"cited_work":{"arxiv_id":"2505.11423","doi":"10.48550/arxiv.2505.11423","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.11423","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"When thinking fails: The pitfalls of reasoning for instruction- following in llms","venue":"ArXiv.org","work_id":"0bf7d75b-5a69-4f2a-ba16-1e22b09d053b","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2505.11423","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:bdcb1bac9327c65eb6457da3a96ff2e2577d0d85e85fa77c0b1049375642a6fe","observation_id":"3c62f23e-7361-4d4b-a9b9-1d85788b7df5","resolution":{"observed_at":"2026-05-11T19:31:08.525902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15404","last_updated":"2026-04-20T03:42:03Z","snapshot_observed_at":"2026-08-06T05:45:06.050686Z","submitted_at":"2025-05-21T11:45:29Z","title":"How Should We Enhance the Safety of Large Reasoning Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":"2505.15404","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15404","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How Should We Enhance the Safety of Large Reasoning Models: An Empirical Study","venue":"cs.CL","work_id":"af5e4daf-f9c5-4ac1-baf1-7c4a31f41ab2","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2505.15404","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:23b4effd4d2019ecfc214251b0fd42ca2616fe15710c92e249c4974f7f252fc8","observation_id":"a62e08f7-4b3a-4732-bc87-5e44730e9cdc","resolution":{"observed_at":"2026-05-11T19:31:08.488550Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12966","last_updated":"2026-06-09T04:02:52Z","snapshot_observed_at":"2026-08-02T23:42:58.142462Z","submitted_at":"2026-02-13T14:33:13Z","title":"ProbeLLM: Automating Principled Diagnosis of LLM Failures","version":2},"cited_work":{"arxiv_id":"2602.12966","doi":null,"metadata_source":"pith","pith_arxiv_id":"2602.12966","snapshot_observed_at":"2026-07-03T14:28:31.386601Z","title":"Probellm: Automating principled diagnosis of llm failures","venue":"cs.CL","work_id":"d3b4c8ae-432e-4d96-911a-c72cb7fa211f","year":2026},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2602.12966","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:cac1ac7379feb61f1e6a9e844adf6793abb82817362d9f7898c9f0062d5a1246","observation_id":"1e1b4f2a-747c-4ddf-9282-4b6491c86229","resolution":{"observed_at":"2026-06-10T02:11:49.648006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Star-1: Safer alignment of reasoning llms with 1k data","venue":null,"work_id":"feb2e3a5-eafc-4a20-b75c-e782a23373f6","year":2026},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:890b21bed515f746a41ded53036328b48802b645d8daabcdd7164f427cf10a35","observation_id":"11ffb87a-1cbe-4bca-95bd-96fceec1271f","resolution":{"observed_at":"2026-05-26T13:57:26.074078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.14999","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning to rank chain-of-thought: An energy-based approach with outcome supervision.arXiv preprint arXiv:2505.14999, 2025a","venue":null,"work_id":"ff7137e0-6c1e-4e0e-9915-9806570484ec","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:991133e725946aea577cd8e24c0874f12c72078cd5abc6de5a425b8b7bff4de9","observation_id":"ac0b2d22-8923-4de2-82fa-0fd5fd7ff2f4","resolution":{"observed_at":"2026-05-11T19:31:08.510440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.00555","last_updated":"2025-06-05T03:20:54Z","snapshot_observed_at":"2026-08-01T20:19:04.242454Z","submitted_at":"2025-03-01T16:42:01Z","title":"Safety Tax: Safety Alignment Makes Your Large Reasoning Models Less Reasonable","version":2},"cited_work":{"arxiv_id":"2503.00555","doi":"10.48550/arxiv.2503.00555","metadata_source":"arxiv_reference","pith_arxiv_id":"2503.00555","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Safety tax: Safety alignment makes your large reasoning models less reasonable","venue":"ArXiv.org","work_id":"b0e63685-280f-43d8-adf7-2603cb1c2798","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2503.00555","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:77c198cb81bfec6e62529b46ee4aafc3c62ea5e192dbb7896665770e4b2624a1","observation_id":"35fe793b-e398-4e40-aabc-afc3fa2e4268","resolution":{"observed_at":"2026-05-11T19:31:08.544413Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Safechain: Safety of language models with long chain-of-thought reasoning capabilities","venue":null,"work_id":"780726b8-2dc4-4795-81eb-9a468ec44f62","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:e1859ae6817e0f1f0397b10115565fe92b2f539f393dbccd767d5722b0f36308","observation_id":"ca779a7f-584d-4fb3-a023-9c220b76df6c","resolution":{"observed_at":"2026-05-26T13:57:26.088141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.11473","last_updated":"2025-12-07T02:14:12Z","snapshot_observed_at":"2026-08-07T08:44:55.120774Z","submitted_at":"2025-07-15T16:43:41Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","version":2},"cited_work":{"arxiv_id":"2507.11473","doi":"10.48550/arxiv.2507.11473","metadata_source":"pith","pith_arxiv_id":"2507.11473","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety","venue":"cs.AI","work_id":"25569634-c9fc-4cdf-97bb-6cc02c0688c3","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2507.11473","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:46f4a283221a33cdbbb3dca877cf87ee621b226a5f6130436eb65f0030b2d6a5","observation_id":"00545680-df47-4709-8e81-3799ff98586f","resolution":{"observed_at":"2026-05-20T14:19:45.019656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:05.902435+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-06T00:58:30.657180Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":"2312.06681","doi":"10.48550/arxiv.2312.06681","metadata_source":"pith","pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Steering Llama 2 via Contrastive Activation Addition","venue":"cs.CL","work_id":"3317feaa-e788-45fc-95aa-4ea20028b55b","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:4eca7ee0b325d7dad25d716eaaa0677713c653bbaa2f70be0ec4db3d6b376273","observation_id":"04c7a832-6e0d-42d5-9330-00ad8d20f2b9","resolution":{"observed_at":"2026-05-11T20:37:21.847050Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.515131+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.515131+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adaptive activation steering: A tuning-free llm truthfulness improvement method for diverse hallucinations categories","venue":null,"work_id":"36acd82e-50b4-4824-af5e-2f056893b4c4","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:3a05f127e8ea04db132d896ba9c32fdbf4a491ff01ab2950f0fd8fab4297756f","observation_id":"7c00eba0-b7fa-48f0-ac4a-88588734cea1","resolution":{"observed_at":"2026-05-26T13:57:26.109452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05907","last_updated":"2025-02-17T20:23:19Z","snapshot_observed_at":"2026-08-04T04:21:28.594163Z","submitted_at":"2024-09-06T15:47:40Z","title":"Programming Refusal with Conditional Activation Steering","version":3},"cited_work":{"arxiv_id":"2409.05907","doi":"10.48550/arxiv.2409.05907","metadata_source":"pith","pith_arxiv_id":"2409.05907","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Lee, Inkit Padhi, Karthikeyan Natesan Ramamurthy, Erik Miehling, Pierre Dognin, Manish Nagireddy, and Amit Dhurandhar","venue":"cs.LG","work_id":"7004efd7-1ce9-49e7-b08f-67800b3a15ca","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2409.05907","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:8818159f1cbdba7f71fcdaf7e9baddd080f6ba1c322fbae19b4d50a5af7f325b","observation_id":"46c9ad98-03ac-416c-8f7c-b80c3038ee72","resolution":{"observed_at":"2026-05-11T19:31:08.535840Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.12299","last_updated":"2025-02-24T21:01:53Z","snapshot_observed_at":"2026-08-03T22:44:00.205551Z","submitted_at":"2024-10-16T06:58:49Z","title":"Semantics-Adaptive Activation Intervention for LLMs via Dynamic Steering Vectors","version":2},"cited_work":{"arxiv_id":"2410.12299","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.12299","snapshot_observed_at":"2026-07-03T20:28:55.179847Z","title":"Semantics-Adaptive Activation Intervention for LLMs via Dynamic Steering Vectors","venue":null,"work_id":"5e75121d-87a9-4d86-8eb0-e16599b3adc7","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2410.12299","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:d01c7411711d69f7741206708c8796d91106b3477aeee4c7772798ecf28bcf11","observation_id":"ff522ec8-0e79-4939-b6f1-5ec93cf5f005","resolution":{"observed_at":"2026-05-11T19:31:08.558655Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-property steering of large lan- guage models with dynamic activation composition","venue":null,"work_id":"332e0d1f-ff46-4766-ba81-e0b994f1086d","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:514df3427941acd2113d57f94dc3979f40427b3959a49fecd6206c38e125575a","observation_id":"e1d8af4d-8dbb-4b86-b255-ca81c8fceaa7","resolution":{"observed_at":"2026-05-26T13:57:26.178693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T14:45:00.494133Z","title":"Mitigating content effects on reasoning in language models through fine-grained activation steering","venue":null,"work_id":"ec4122a3-a49f-44c7-9f4b-f451e57bd4c5","year":2026},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:db4792078ae57f1e6f2f8d6b4e191b4f5d3442523e32642962c8a4a1724e5ee6","observation_id":"5a6a0ac0-eff6-45db-ac12-57e71bcd9b59","resolution":{"observed_at":"2026-05-26T13:57:26.170478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.01042","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:08:42.749436Z","title":"org/abs/2502.01042","venue":null,"work_id":"d01742b8-94af-4998-8813-ba590a1e0b3c","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:06ea0a9536b5379b7ee29ce2aca808ea8a776aeeef10ff629d5f902ad51065dc","observation_id":"e252ed1f-a756-4588-9d07-1c124f602b3c","resolution":{"observed_at":"2026-05-11T19:31:08.567928Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01470","last_updated":"2024-05-02T17:00:02Z","snapshot_observed_at":"2026-07-06T18:08:56.480769Z","submitted_at":"2024-05-02T17:00:02Z","title":"WildChat: 1M ChatGPT Interaction Logs in the Wild","version":1},"cited_work":{"arxiv_id":"2405.01470","doi":"10.48550/arxiv.2405.01470","metadata_source":"pith","pith_arxiv_id":"2405.01470","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WildChat: 1M ChatGPT Interaction Logs in the Wild","venue":"cs.CL","work_id":"799d0d7b-7d66-40bb-b17f-205e5d2f3e13","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2405.01470","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:8de5b666c4ad60ff6b023a6c6ca330508eb38ec7de18a598e83cff43d3b614f9","observation_id":"71826e1d-8ec6-479f-aa4f-2db7df5a936d","resolution":{"observed_at":"2026-05-16T10:43:02.331896Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pku-saferlhf: Towards multi-level safety alignment for llms with human preference","venue":null,"work_id":"0607b37e-807f-47c5-885b-e3e23bb74d54","year":2025},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:df710d4bb79d49f75ce44825847432de7f693da18dcc0a11465631190d8a453f","observation_id":"d511e349-85f8-4d1f-9b77-3d9f79b684b8","resolution":{"observed_at":"2026-05-26T13:57:26.045877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03027","last_updated":"2024-11-24T06:22:37Z","snapshot_observed_at":"2026-08-06T14:20:00.145899Z","submitted_at":"2024-04-03T19:23:18Z","title":"JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks","version":4},"cited_work":{"arxiv_id":"2404.03027","doi":"10.48550/arxiv.2404.03027","metadata_source":"pith","pith_arxiv_id":"2404.03027","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Jailbreakv-28k: A benchmark for assessing the robustness of multimodal large language models against jailbreak attacks","venue":"cs.CR","work_id":"70be9f1e-35df-4670-9f5f-fb5d97c1816f","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2404.03027","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:595e609f6a4a32db534cbd101870d19ec77108b9ff51e660b10636ed29645025","observation_id":"9c5a0843-451e-41f3-9f0f-820e9643e0db","resolution":{"observed_at":"2026-05-11T19:31:08.469807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Beavertails: Towards improved safety alignment of llm via a human-preference dataset.Advances in Neural Information Processing Systems, 36: 24678–24704","venue":null,"work_id":"bc856945-5b4d-4e82-a3ae-97bacd8d6320","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:4746b27af3000f25f15a19bbc20172ec8d211aaceba8a339f6b01d6d74425834","observation_id":"7115fcab-9f9f-446d-a946-839d48bf9875","resolution":{"observed_at":"2026-05-26T13:57:26.166710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the resemblance and containment of documents","venue":null,"work_id":"84d86f21-e36e-4d4b-a79e-e231312c77d0","year":1997},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:08f363a21f92d2e32abdab7672ac10ae651688a1d6f7048271bb5b8de2689e58","observation_id":"10d27ae0-380c-4587-9a2b-7deb3effa3a6","resolution":{"observed_at":"2026-05-26T13:57:25.919044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wildteaming at scale: From in-the-wild jailbreaks to (adversarially) safer language models.Advances in Neural Information Processing Systems, 37:47094–47165","venue":null,"work_id":"eda73738-0f50-417e-b5ea-ed46673880ff","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:e59790366c062b7957e6d454f205845bdd49c482e6e4323363142ea28016455e","observation_id":"baa40c6c-6824-472a-92df-0812af223d95","resolution":{"observed_at":"2026-05-26T13:57:25.909839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Challenging big- bench tasks and whether chain-of-thought can solve them","venue":null,"work_id":"301b2d11-fcb9-48a2-8d09-3f6752fbdbc2","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:8454246d1a60af38ed130c83da43bc49fb9a73db507a28abcd13cc6232f8cc7a","observation_id":"fbacaffe-f6a5-4379-8982-1073d2ef555f","resolution":{"observed_at":"2026-05-26T13:57:25.922513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:a1a1c6d8ef91cd3f1b7f03a4beffa9f35c7343d6c77a54e09d918ea1c0163030","observation_id":"06b0b449-364c-46fa-8f2a-4093e9e44006","resolution":{"observed_at":"2026-05-11T19:31:08.504038Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:915137d08f94e039610ca8195b90220b75af2a583133a67dccd162e5a2548a7e","observation_id":"10c852a2-5c75-44cd-9d4d-2935e19fe3ad","resolution":{"observed_at":"2026-05-11T19:31:08.463524Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World Health Organization","venue":null,"work_id":"21722e63-8764-4e3a-b4d2-e37a3b16f9e3","year":2019},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:645b9bf066e060acf042804a3ba1a637094ddeb84a937f2825d488c9109eb30e","observation_id":"38d82792-2603-4925-ab59-27de828e603a","resolution":{"observed_at":"2026-05-26T13:57:25.913220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Injury prevention and control.Emergency medicine clinics of North America, 25(3):901–914","venue":null,"work_id":"12785cf0-aefa-4d6d-ad53-69545ae60e51","year":2007},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:2cf0a5000cb11c3f0de47e52f5ede2b2cdfc0d4cb2aeb50f60599b1206f24bb1","observation_id":"17c88fd1-57e4-41ed-9cb3-0e1c4803b2cc","resolution":{"observed_at":"2026-05-26T13:57:26.003103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ethical principles of psychologists and code of conduct","venue":null,"work_id":"22b72096-4353-4c5e-adc8-7adfc449bd4a","year":2016},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:97746be641bc649a98010378f3991baa8d9e59003cf2c4c8e8658d2ba0eb4719","observation_id":"e1500e52-3736-4058-8ebf-9feac6fb12ac","resolution":{"observed_at":"2026-05-26T13:57:25.876543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"World Health Organization","venue":null,"work_id":"a4c5e0af-55c0-4d78-8f4b-36372ea544e1","year":2013},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:c4aaad1a899ab4144713bad4e3a4d79ddcef694f1437dd9d4cca8ae05101ba1d","observation_id":"2ac933a8-af92-4dd5-b53f-b4e78add2aa4","resolution":{"observed_at":"2026-05-26T13:57:25.879629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"APA Professional Practice Guidelines.https://www","venue":null,"work_id":"e27bcc03-c288-4da3-8c38-8fbab40b7da7","year":2026},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:f92707a2ff1088940e70659085c155f145f9b2ed47caf2031f4593f31c11894c","observation_id":"08434dc5-75be-4ea1-b349-95314adcea78","resolution":{"observed_at":"2026-05-26T13:57:25.882523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"National Suicide Prevention Lifeline","venue":null,"work_id":"8660a8d1-a793-49c8-bc79-8c6b56be4861","year":2022},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:fbc68b2e8b40098e6a426380db9c5dcd9cd8f2436cfb4779735a4cb2129bae5b","observation_id":"dc5a6b7c-e3e7-42eb-bd95-cc2f5f2eff02","resolution":{"observed_at":"2026-05-26T13:57:25.896046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"American Psychiatric Association Publishing","venue":null,"work_id":"4af654e7-7724-4850-8c44-31d0193c3f5b","year":2022},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:6ea470e4644ade99c69033c4d85eddd9d6c99bb72a43b0bee579f92f750277d1","observation_id":"39e3b89c-f927-4901-86a8-d5cc41358839","resolution":{"observed_at":"2026-05-26T13:57:25.925651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"18d94451-ca91-452c-9617-01d22a7e51f0","year":2011},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:34884e2176ed4bd048dc384e1eeb12eba17662a1591e982dc8daa05793570ab2","observation_id":"2eb60187-32f8-4487-a3e3-c08138a2d239","resolution":{"observed_at":"2026-05-26T13:57:25.889797Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"General Data Protection Regulation (GDPR)","venue":null,"work_id":"badf3f48-9e7a-4977-b9c5-fea9422e921a","year":2016},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:1436dab3f65396faf65312bc435a791d69d65bcdb7db43e05c3533df07ab5c9f","observation_id":"a843e36a-e910-4164-aa29-0af4b25fe9f0","resolution":{"observed_at":"2026-05-26T13:57:25.860069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"California Consumer Privacy Act (CCPA)","venue":null,"work_id":"96c5e3dd-518f-4a23-9295-dc36438d67d6","year":2018},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:5b6d4ee4444ee0a06b5d892e0bf56edf45fe5ea8311b372a4c4f8c68d8f80127","observation_id":"c17983c2-fb06-40a1-89a8-772c8386efc7","resolution":{"observed_at":"2026-05-26T13:57:25.820440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"NIST Privacy Framework: A Tool for Improving Privacy through Enterprise Risk Management","venue":null,"work_id":"1865a5e0-4ba7-4caa-b818-cf85cbc2c675","year":2020},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:a9f4df788f745721d1f17f4f166426ee9c17ba0dbc8f82d59ee6c47c27c23cb3","observation_id":"ef2daa38-a8b6-4339-8614-a509e9e0cd69","resolution":{"observed_at":"2026-05-26T13:57:25.856831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Department of Health and Human Services","venue":null,"work_id":"301b5844-940d-42c2-a934-30f6fb603733","year":1996},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:344fb7dc2a4593c4975e842d3bae148c669a756250d3f10cedc88df4b6250988","observation_id":"6e01331e-f849-468f-8429-d6d738289c6b","resolution":{"observed_at":"2026-05-26T13:57:25.850340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://www","venue":null,"work_id":"cc6fdfcf-d03c-4322-b492-457f914c31b3","year":2022},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:4b7a0600ecc6933a665f47e9f0687445b44fbff7a0677534e9fd6a7450522414","observation_id":"0ebcde04-b84d-4fd2-ac56-bad971c85995","resolution":{"observed_at":"2026-05-26T13:57:25.989301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"NIST Cybersecurity Framework 2.0","venue":null,"work_id":"e8044c4a-e887-4ca0-b258-e91f4053a14a","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:9b89209d1a8a3f8a485bb7ffd97fe2f6442befb722cf341c3c6fa7a714b1c277","observation_id":"82275ce1-819a-456a-9e32-af4e6223edd0","resolution":{"observed_at":"2026-05-26T13:57:25.817252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"MITRE ATT&CK Framework","venue":null,"work_id":"5fecd44d-da1e-49fe-9cf7-ce49fbf3cc2a","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:77ad8d657fd2f14973267418db23800cf4bebded241cb05ef51a96099e43db00","observation_id":"7fa1dc26-aae7-4881-9bbb-02ef6446e20a","resolution":{"observed_at":"2026-05-26T13:57:25.823197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OWASP Top 10 Web Application Security Risks","venue":null,"work_id":"84f5e6ce-33a1-4c0d-bc9f-e5c3639dd07e","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:7e710afde7f6b607b5fd0594112c0c53f7690022ba149e67bd8b80fe82136bdf","observation_id":"98e642c8-8b8f-4c43-b0c8-a6623e64fc1a","resolution":{"observed_at":"2026-05-26T13:57:25.801065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"04d471b1-a9fc-4fd2-ba6c-573699506a74","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:339c8deeff39f5fc5a391807fb8a17638b62ded6c2e8d49400fa552ee0c24d70","observation_id":"21149034-d6bb-4493-b5e4-e935c7b76770","resolution":{"observed_at":"2026-05-26T13:57:25.794344Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Media and Information Literacy Framework","venue":null,"work_id":"cbf7f54b-d0e4-4dc0-8019-6ea1091145ad","year":2021},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:15dc7ee99f50a6c8e2a32dbe6a79bb04bfc645975678a8fa893e2140cbb27397","observation_id":"1adfc352-43f4-4bea-b9d7-4069a8c224e2","resolution":{"observed_at":"2026-05-26T13:57:25.837365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reuters Institute Digital News Report 2024","venue":null,"work_id":"e4a032c9-32d8-45ad-b154-33f357ef77f6","year":2024},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:076f43731df594ab8c65ecdf89ff942927b87333e714b9a01d486892666ddc89","observation_id":"d21fca47-ec4c-4a26-973c-23f3860efd11","resolution":{"observed_at":"2026-05-26T13:57:25.886816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Information disorder: Toward an interdisciplinary framework for research and policy making.Council of Europe Report, 27","venue":null,"work_id":"01dac03d-9b77-4dcc-8152-03c2f62b971b","year":2017},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:169ad456c2ea335c11dfb0c1eded3d0b3ce632603005ab79c4ad59dfa963f524","observation_id":"e8291e0e-f809-442c-96ba-7394e8e890c9","resolution":{"observed_at":"2026-05-26T13:57:25.899753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Managing the COVID-19 infodemic","venue":null,"work_id":"bab3891c-5c2e-4486-8d5e-deefe8b10fb3","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:4787addb2d6294639101bad7d37ad27ae601db8fa285149ccf7e4f34441cd366","observation_id":"2ba8d34d-beea-456c-8519-b711c51a3e72","resolution":{"observed_at":"2026-05-26T13:57:25.960796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ab6cfedb-3ada-4bf9-910e-2dc18340297d","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:09bbcf6407d6d3f1122b2cc3f240c4a815832865bbf680082bbb5ceade077db2","observation_id":"3fe58444-d785-4e6b-b59d-b2dfd11ddaae","resolution":{"observed_at":"2026-05-26T13:57:25.973368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SPJ Code of Ethics","venue":null,"work_id":"ea3529f1-7333-4215-8b50-da2bb2fce223","year":2014},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:95f214c5d21c47c83aeb0bbfedae88d1547fdeb4480f100e3e50be1ce46ae3e7","observation_id":"8a37add7-e044-4227-b4b6-b0d0343550ce","resolution":{"observed_at":"2026-05-26T13:57:26.162610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Universal Declaration of Human Rights","venue":null,"work_id":"6e30de63-0e3a-416c-87ec-3532f3a8cf8e","year":1948},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:57b17d2f06514fcf6c5a736cd2b611796027afcb978fe6ae15779538c0e906b3","observation_id":"523ace93-4942-45c3-bf1a-8bb34e077088","resolution":{"observed_at":"2026-05-26T13:57:26.159111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"International Covenant on Civil and Political Rights","venue":null,"work_id":"611a63f4-ebcc-4505-9dbb-0c9b866c1096","year":1966},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:bf31057b63426b8b0bdfa9a7331100b0f01bc63d6dfcb271d8b62fdba66f8eda","observation_id":"3d734e2c-6b5b-497f-986e-8c94366a4370","resolution":{"observed_at":"2026-05-26T13:57:26.138281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convention on the Elimination of All Forms of Discrimination Against Women","venue":null,"work_id":"a30fee83-b722-4b08-998c-e01be48ff1b1","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:1921706f09e9252ad25ff05096cd105deea3c29288bc3d8e3ed9686965553678","observation_id":"78778142-a4d5-446b-a24b-a7b6818ecccf","resolution":{"observed_at":"2026-05-26T13:57:26.145415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fd7984ae-5612-4a27-ad2a-a6644a2a058a","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:d5ae439d626c1c64af41a4d2d126412781ba1feac817132e287faaa56de3321b","observation_id":"34245242-642e-4b80-b80a-ebbf54c2cf3f","resolution":{"observed_at":"2026-05-26T13:57:26.155457Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Department of Justice","venue":null,"work_id":"514a7378-903e-42f7-a5b2-f933ddc53630","year":1990},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:e20be1ca79a5e65314124a61764d6689b6cba38cc963dd20861af102e979f542","observation_id":"99d110ab-f98e-457d-b4ac-052f099b5a5f","resolution":{"observed_at":"2026-05-26T13:57:26.117095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yogyakarta Principles on the Application of International Human Rights Law in Relation to Sexual Orientation and Gender Identity","venue":null,"work_id":"af425d15-a450-47f3-b453-6ca5ebea18fa","year":2007},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:8b1345c05c39fd3710ae353143872262907ee7d77f67b855f3c18e5e170f88b8","observation_id":"113a7f1d-980a-4c9f-9402-b535196b72f2","resolution":{"observed_at":"2026-05-26T13:57:26.113237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ethics Guidelines for Trustworthy AI","venue":null,"work_id":"06ef5546-ccde-47ff-a931-03d81cf75a70","year":2019},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:40cb81f34fe32a835319c451d0585445e3a79ef9137b5a4959fea6f4cb02f683","observation_id":"40b8057b-e7d8-4880-9bf5-8b306641539e","resolution":{"observed_at":"2026-05-26T13:57:25.853410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Rome Statute of the International Criminal Court","venue":null,"work_id":"ad1fe309-c61f-4dd5-9c92-24db498d7c43","year":1998},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:81849616fb9b651954f63b66d7b5ad1721298a77c83dc65d15746f7b5d34be80","observation_id":"165c8f72-84c6-4d23-bfca-023113390a61","resolution":{"observed_at":"2026-05-26T13:57:26.120539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"United Nations Convention Against Transnational Organized Crime","venue":null,"work_id":"fb676ad8-e19f-44bb-b06a-3a32b4c268a9","year":2000},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:6027695d4d46fe55b082e87dab115eaa694be99ec6ea8ea5cacc7e18c311f158","observation_id":"127056a1-d449-452c-838f-8a13bc1a6ceb","resolution":{"observed_at":"2026-05-26T13:57:26.098513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Model Rules of Professional Conduct","venue":null,"work_id":"42ce4808-68c3-4c37-8480-7e8ce0d54182","year":2020},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:f8f8f425d5a739b82eb93ae9ad6eb4b731d23be8cdb850f5d00e30f302d6b5f0","observation_id":"deec81b7-b63d-454c-9e6d-d92deb9d17cd","resolution":{"observed_at":"2026-05-26T13:57:26.102186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Foreign Account Tax Compliance Act (FATCA)","venue":null,"work_id":"b4200bb4-b7cb-4f54-835e-d33f211feb96","year":2010},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:26be89505f54458427d3a162ba05afc7e87b569d40715f0545ada7e095846cf0","observation_id":"f43e65cf-048b-449a-8080-6cbd37c74f38","resolution":{"observed_at":"2026-05-26T13:57:26.127223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Congress","venue":null,"work_id":"02e8c0a6-cbb9-43dd-99e1-94246dabaa4e","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:29695a363156eb49115a29fd20fc009d487d1b4e21ce538d81efdba20473682b","observation_id":"59585a35-c548-442d-8386-a0aef55e1071","resolution":{"observed_at":"2026-05-26T13:57:26.080991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Convention on the Rights of the Child","venue":null,"work_id":"bb7f13d1-ac91-4242-b2fe-ad03b79253db","year":1989},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:0686ab229b1dd9ad070003848c9d620f82701a8fbc1d5b2691fb9abd2adefa81","observation_id":"b091e895-2edf-49cf-90b4-c564a77cce9e","resolution":{"observed_at":"2026-05-26T13:57:26.084263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Online Safety Resources","venue":null,"work_id":"13e31e57-e9f1-41a3-8932-0a515c1ac532","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:6f41b27d783c5f22f60121000ff6a9215f3bbfb74d3e96f3c8e20ce21eb0df3a","observation_id":"fc60ddd3-aa40-43a8-b794-a075aad28d99","resolution":{"observed_at":"2026-05-26T13:57:26.091443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Children’s Online Privacy Protection Act","venue":null,"work_id":"b7201a9b-73ce-40ab-be77-e5ff82961676","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:d2193faa934b6fd5e4a724b482b1e44c2cb36c66407cbce213567f81ae69fc23","observation_id":"ebc250c7-3aa0-40ea-a8c5-e40a82fceff7","resolution":{"observed_at":"2026-05-26T13:57:26.077576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9f876cff-38ca-4cac-840c-c939e03b41f7","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:e33e2a42c07b8bad8762d020ffc5675239ae68cf8e4f1ce2bb689f314fe96d17","observation_id":"7923f74b-0573-4cdc-86bf-99df3530ebfd","resolution":{"observed_at":"2026-05-26T13:57:26.067818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Council of Europe Convention on the Protection of Children against Sexual Exploitation and Sexual Abuse","venue":null,"work_id":"20efdaba-1b12-4b31-b9ea-5cc1b4e5a079","year":2007},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:81a18003ab3021c0fa139a42e914a1cb77643441f9b1868e157fc300f842308a","observation_id":"b04c7840-84e9-4f3c-a866-871bd0e856f3","resolution":{"observed_at":"2026-05-26T13:57:26.064698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Basic Books, New York","venue":null,"work_id":"73a18b09-e6c9-48ca-9ac8-7ca44b6024ef","year":1969},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:d11b26d72b3f2e5175ce4fdd38c08ab38b9450d15bbcb9aadd3cb2208db849cb","observation_id":"5b78b106-595e-45d1-af42-7348e600fc5c","resolution":{"observed_at":"2026-05-26T13:57:26.148726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FATF Recommendations","venue":null,"work_id":"f99a8b4f-e60b-42d7-aa71-7a0a1151bb01","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:57937b53e408498ff35c0ecef9fe078f1c34e3773d7c5424513dec9ecc411fac","observation_id":"09994aaa-4531-480e-a736-b80e272edfc4","resolution":{"observed_at":"2026-05-26T13:57:26.049037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"40783aa2-47bc-4e86-a5bd-06e914f2bffa","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:5c5d1212e8dfee5e82a6f9d8147d58b99c44d3ea54a13b29731bf13367850d38","observation_id":"90ec5798-228f-4f35-9538-7d7ff0276778","resolution":{"observed_at":"2026-05-26T13:57:26.035055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Securities and Exchange Commission","venue":null,"work_id":"3b3bf50f-29e4-4037-9879-52e8cbc756ca","year":1940},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:fcffcbaa43d310a962031b540c9fe9e5f161df61daab4e4b545cb7f2284e0728","observation_id":"4df6d379-3d68-466e-a49d-d974a599f791","resolution":{"observed_at":"2026-05-26T13:57:26.057884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Basel III: International regulatory framework for banks","venue":null,"work_id":"0dc664ec-d0ad-4cb6-abe8-1d6863b8ea73","year":2017},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:e680ab74b1bedfac3f63d6ad1c9772271129b68f11e37283772f5373cdbdab3c","observation_id":"0083c4d4-a5ab-4250-9cc8-dfb7b4922457","resolution":{"observed_at":"2026-05-26T13:57:26.031757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Congress","venue":null,"work_id":"2cd1c509-b4bc-4a6b-92cb-98cf5b1a7505","year":2002},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:40c773532e56611113666559a6f6ff6a733b5f9df69cdd15d5d855809fcb12d1","observation_id":"b9658cba-2cd8-43c4-b422-5b1bc0df5343","resolution":{"observed_at":"2026-05-26T13:57:26.018869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Consumer Financial Protection Bureau Guidelines","venue":null,"work_id":"bdeb63e1-65bf-4682-96b0-58ab0611ea96","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:d2074ff9d76a14df71c2520691601474255f2a8dbbcb81ec65bc0a7f1fc77f8f","observation_id":"68f79a6a-27a4-4ce5-813e-d62108b954e0","resolution":{"observed_at":"2026-05-26T13:57:26.038802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dd8235f2-5457-4055-bea8-487c83afdb57","year":null},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:6c96b1681b875b7a8c5431ddd803550866286196ab8678f35cfba1a742916fbe","observation_id":"3728c64f-5317-4df6-bf58-6e7e7ee28442","resolution":{"observed_at":"2026-05-26T13:57:26.041976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Environmental Assessment Guidelines","venue":null,"work_id":"471f1154-fa62-4054-85bf-429a00065d29","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:9c01632800e4053bd6002c7dba54bfea2d799c528bb299869b16a85680b81849","observation_id":"dc6915f5-43e6-4c0f-92b8-9798078ba8ed","resolution":{"observed_at":"2026-05-26T13:57:26.006557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Environmental Protection Agency","venue":null,"work_id":"d5e7d6cb-ef31-42d3-8b04-48ff92f9b66f","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:6fb527fecd72ebffd4a4523c5cdf946d71e69ce98ecb209ba252bf50c53d8b05","observation_id":"4b39f238-7668-4f31-9236-88da1a4b12a9","resolution":{"observed_at":"2026-05-26T13:57:26.012986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stockholm Convention on Persistent Organic Pollutants","venue":null,"work_id":"0bc8df61-ac67-4c73-a185-63ebe70ce04e","year":2001},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:bd56071c938bd8b3795b1134e08407aacc5a334a9081e49ece4b9cec4e4f48d5","observation_id":"9cf84df0-6e0b-4d94-9414-30b684d71a1d","resolution":{"observed_at":"2026-05-26T13:57:26.010103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Paris Agreement","venue":null,"work_id":"9df6508c-2c71-4237-848d-6f3808a4a97e","year":2015},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:98a2ec136d754debe95ec44f6967aa8a1c03f0dc29388d879e355e54f860a913","observation_id":"4abf752f-a017-4e1e-9819-b111e90cbfb5","resolution":{"observed_at":"2026-05-26T13:57:26.015826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Environmental Protection Agency","venue":null,"work_id":"1f71e3f2-faad-4e01-8461-d214a520ac0c","year":1994},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:f37dae1b039e1686b35f6f3aee982bda7c1882f36718d0fbfd418b80f8cdd28e","observation_id":"5038fa5a-9adf-496b-8ae5-92ca8c0d54ad","resolution":{"observed_at":"2026-05-26T13:57:26.051968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Guidelines for Drug Policy","venue":null,"work_id":"ec009773-02fa-4b64-8d7a-25c94ba2fdd1","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:ccafcb609155f04707d9e5da581b2dbe5549f86296e4df4b45fe5d9a78f8fd37","observation_id":"ad477927-54c9-457c-bbe7-5761a8180c91","resolution":{"observed_at":"2026-05-26T13:57:25.982647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Single Convention on Narcotic Drugs","venue":null,"work_id":"5ff4ca87-7d68-4141-a009-50ac822b3058","year":1961},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:181e618550aa1929887f65ade846e880d19a8649cab34a172958d8c1bc8e3fbe","observation_id":"1d74c604-b0fe-4c64-8bde-3f420ef9301e","resolution":{"observed_at":"2026-05-26T13:57:25.985763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Controlled Substances Act","venue":null,"work_id":"0ecf42ff-9c28-4a52-bc81-6fe2df287949","year":1970},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:7e1cf0f8d9fc4607fb6fdfa5dcea37a6c731bb29d35a7935390a0d52f3960ccb","observation_id":"1659f21b-7544-4dbf-8ec0-04da72ac1eb3","resolution":{"observed_at":"2026-05-26T13:57:25.979841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Treatment Guidelines","venue":null,"work_id":"862087d3-6fa4-472d-aa75-597a493d18ae","year":2023},"citing_paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-08T11:49:47.994456Z"},"links":{"citing_paper":"/paper/2605.05678"},"observation_digest":"sha256:58c3b61cd37abcf1691e6223c5dd24418ab028625e5d67123c7e5081758363b2","observation_id":"92599a75-fd32-4b6d-b578-706a3cbd6e48","resolution":{"observed_at":"2026-05-26T13:57:25.999407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.05678","last_updated":"2026-05-07T05:12:56Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-02T07:12:00.817422Z","submitted_at":"2026-05-07T05:12:56Z","title":"Chain of Risk: Safety Failures in Large Reasoning Models and Mitigation via Adaptive Multi-Principle Steering"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":7,"verified_exact":19,"verified_fuzzy":70},"total_outbound_references":139},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 100 of 139 outbound references and 1 inbound Pith citation observation for arXiv:2605.05678."}