{"as_of":"2026-08-09T06:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13511efe46f1c9fc5673a764f2e256b0f45429ad4cdc67aec0a928bdbf8ecaad","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:12:32.717267Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T07:46:16.678202Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T00:47:29.934082Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":"2507.03662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-03T00:47:29.934082Z","title":"Isaia Gisler, Zhonghao He, and Tianyi Qiu","venue":null,"work_id":"bfe2d11d-e3ab-40c1-99cf-197a96702ba4","year":null},"citing_paper":{"arxiv_id":"2605.12798","last_updated":"2026-05-12T22:27:32Z","snapshot_observed_at":"2026-08-06T10:40:00.678805Z","submitted_at":"2026-05-12T22:27:32Z","title":"Emergent and Subliminal Misalignment Through the Lens of Data-Mediated Transfer","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-14T20:36:44.104197Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2605.12798"},"observation_digest":"sha256:927ac355969f5d6f037cfde474e88730af182e9dd022abbbbe30b00e72a75688","observation_id":"bb166d1b-0ba0-4538-9556-df44c085b1e4","resolution":{"observed_at":"2026-05-14T20:39:26.793422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":"2507.03662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-03T00:47:29.934082Z","title":"Isaia Gisler, Zhonghao He, and Tianyi Qiu","venue":null,"work_id":"bfe2d11d-e3ab-40c1-99cf-197a96702ba4","year":null},"citing_paper":{"arxiv_id":"2606.07612","last_updated":"2026-05-29T16:38:53Z","snapshot_observed_at":"2026-08-03T13:49:06.792444Z","submitted_at":"2026-05-29T16:38:53Z","title":"Position: Anthropomorphic Misalignment Research Needs Stronger Evidence","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-28T20:13:53.972585Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2606.07612"},"observation_digest":"sha256:82bf7139efa77504097b99c2171c0eca01b06502ae24ba9c108fed4c188c23bb","observation_id":"a9e7daba-9750-43ab-aaa4-3a5d18d69f6c","resolution":{"observed_at":"2026-06-28T20:22:37.266421Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":"2507.03662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-03T00:47:29.934082Z","title":"Isaia Gisler, Zhonghao He, and Tianyi Qiu","venue":null,"work_id":"bfe2d11d-e3ab-40c1-99cf-197a96702ba4","year":null},"citing_paper":{"arxiv_id":"2606.08044","last_updated":"2026-08-04T12:50:00Z","snapshot_observed_at":"2026-08-07T23:11:38.433528Z","submitted_at":"2026-06-06T08:10:56Z","title":"When Behavioral Safety Evaluation Fails: A Representation-Level Perspective","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T20:04:17.744876Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2606.08044"},"observation_digest":"sha256:669fee60d2bb2ce9c4d7c4b7864d69a631a36f770ffb10adb8da4dea2ebb3a7e","observation_id":"54b7d6bf-2f22-4b85-a8b1-d71a6906e547","resolution":{"observed_at":"2026-07-02T20:57:23.094369Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":"2507.03662","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-03T00:47:29.934082Z","title":"Isaia Gisler, Zhonghao He, and Tianyi Qiu","venue":null,"work_id":"bfe2d11d-e3ab-40c1-99cf-197a96702ba4","year":null},"citing_paper":{"arxiv_id":"2606.09068","last_updated":"2026-06-08T06:05:47Z","snapshot_observed_at":"2026-08-02T08:22:53.597386Z","submitted_at":"2026-06-08T06:05:47Z","title":"Emergent Misalignment Can Be Induced by Sycophancy and Reversed via Alignment Gating","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T17:03:33.199645Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2606.09068"},"observation_digest":"sha256:0be4bd4ddc3184a2b55dbee8fa76e134076c71294fbd6913d7283e98764e9687","observation_id":"9f2ba424-287a-47fe-808c-60bbae68247a","resolution":{"observed_at":"2026-07-03T00:47:29.935594Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-07-11T18:20:40.287006Z","title":"Re-emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs , 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04510","last_updated":"2026-08-03T19:51:37Z","snapshot_observed_at":"2026-08-08T04:50:59.486787Z","submitted_at":"2026-07-05T21:23:15Z","title":"Transplanting, inverting, and preventing a misalignment persona: method-conditional emergent misalignment in Qwen2.5","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-11T18:20:40.287006Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2607.04510"},"observation_digest":"sha256:743a24450922eb4268519fa84e7113d2a7d1bf0889abe2a80657acc06d2665bb","observation_id":"dae3c0ef-8390-43fa-9503-c5e75a1078e8","resolution":{"observed_at":"2026-07-11T18:20:40.287006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03662","snapshot_observed_at":"2026-08-01T07:46:16.678202Z","title":"arXiv preprint arXiv:2507.03662 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21356","last_updated":"2026-07-23T14:19:28Z","snapshot_observed_at":"2026-08-07T19:47:51.895704Z","submitted_at":"2026-07-23T14:19:28Z","title":"Emergent Misalignment Recruits a Pre-existing Persona Subspace","version":1},"reference_index":133,"source":"arxiv_source","source_observed_at":"2026-08-01T07:46:16.678202Z"},"links":{"cited_paper":"/paper/2507.03662","citing_paper":"/paper/2607.21356"},"observation_digest":"sha256:f0a70b2ce78687ca4fd8e93171c411a95f31fa680f4b41300509ed426950ddf2","observation_id":"71991987-2695-4185-8692-2fddc292ff96","resolution":{"observed_at":"2026-08-01T07:46:16.678202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.03662/citation-record","integrity":"/paper/2507.03662/integrity","json":"/paper/2507.03662/citation-record.json","paper":"/paper/2507.03662"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:30.497834Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:30.497834Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:2a6e79922198825e015c2b6f4ee7d21ee664de9cf4fcc019890e492f43fef771","observation_id":"62f4367f-cd43-4297-967f-69d6ae87b075","resolution":{"observed_at":"2026-08-06T20:12:30.497834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:30.565244Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:30.565244Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:103bfdb9180bb07a7d2899d10c7e7a291322b8072fbdaa84502f44f3ea256682","observation_id":"25dbe0fd-3487-41a7-b685-04a8f11c4335","resolution":{"observed_at":"2026-08-06T20:12:30.565244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.138274Z","title":null,"venue":null,"work_id":"78af92a1-44e4-4c17-b8b6-ab747e5fe9a3","year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:30.799717Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:a8d96b28cd932ffaefef686c710378cd2428f038e10b90f8fbb5880af8a95537","observation_id":"a5c470c2-9592-4749-a3eb-23587dfd7d9d","resolution":{"observed_at":"2026-08-06T20:12:33.140998Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-06T20:12:30.963700Z","title":"Bowman, Zac Hatfield-Dodds, Ben Mann, Dario Amodei, Nicholas Joseph, Sam McCandlish, Tom Brown, and Jared Kaplan","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:30.963700Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:4251c92024ec860fe4cfe089234b5a1e95a911579399c217746c100d88b60d75","observation_id":"ca7bb3f9-e6e4-4ac1-8ab9-ecfc7afcde91","resolution":{"observed_at":"2026-08-06T20:12:30.963700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.130588Z","title":null,"venue":null,"work_id":"b488eed0-8d85-42f0-acb5-0d4d12b8a383","year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.086504Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:d7fa3152873f01b26b349d43651a3f4f13cb6d66267219c48016414df75632ba","observation_id":"97a054a0-bc05-4b2c-a4df-343e9ba49a7e","resolution":{"observed_at":"2026-08-06T20:12:33.133118Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:31.194346Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.194346Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:a9ae8acb87af81f789cee0714260b705262a8707320e577e7cc65a107a142d28","observation_id":"b299773b-7daa-495b-bb1a-9afbb6bba5c0","resolution":{"observed_at":"2026-08-06T20:12:31.194346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.122275Z","title":null,"venue":null,"work_id":"1b9356b4-8346-4910-9243-1f1cfc83598a","year":2022},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.342729Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:382aa0ed320b3cdb6c8a9b037629fc484eb2e339732d3e9aa3ef1c27f8c40c60","observation_id":"625618f7-5876-4f5c-9d46-a9ca13d9fed9","resolution":{"observed_at":"2026-08-06T20:12:33.125055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14093","last_updated":"2024-12-20T02:22:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-18T17:41:24Z","title":"Alignment faking in large language models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14093","snapshot_observed_at":"2026-08-06T20:12:31.417382Z","title":"Bowman, and Evan Hubinger","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.417382Z"},"links":{"cited_paper":"/paper/2412.14093","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:99e1d057d8e0cc1cac28784b9d8b6b996bb77c733b5f93c4aa82dc1725d45c56","observation_id":"3cc5fc6c-864d-44a4-b643-d10f4d2acc4a","resolution":{"observed_at":"2026-08-06T20:12:31.417382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-06T20:12:31.510017Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.510017Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:dca032ae2ff291980b00ce663ffce7d82b14b2a594017916e56e7570a6adb3d6","observation_id":"cd9b383d-6907-4e68-a577-33a83da7a7c5","resolution":{"observed_at":"2026-08-06T20:12:31.510017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.114030Z","title":null,"venue":null,"work_id":"e1ec54eb-6d1b-42af-8bf5-f9f051a1bae2","year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.619729Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:e198222ca3e50ea1e7eacd9659040150cdaf436d66dc919bb203b0facd91da74","observation_id":"6ef3bc1d-de03-4454-8877-edee4a792cf4","resolution":{"observed_at":"2026-08-06T20:12:33.116840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23743","last_updated":"2025-06-05T02:01:49Z","snapshot_observed_at":"2026-08-08T08:44:50.972956Z","submitted_at":"2024-10-31T08:58:06Z","title":"What Happened in LLMs Layers when Trained for Fast vs. Slow Thinking: A Gradient Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23743","snapshot_observed_at":"2026-08-06T20:12:31.713901Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.713901Z"},"links":{"cited_paper":"/paper/2410.23743","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:3febf31b0ccd630e5c976ee5f8ce7a040b43e3ff473c52f456d811e85ca1874d","observation_id":"e5f17dd1-7cd4-439e-a439-a55953373809","resolution":{"observed_at":"2026-08-06T20:12:31.713901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:31.818876Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.818876Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:2169c0a762ec8d24e3f2b6da740257acc785a5663cf24c94bedcfab8c70bbb9a","observation_id":"c72ec5de-4211-420b-96be-6e2b12e39de5","resolution":{"observed_at":"2026-08-06T20:12:31.818876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05374","last_updated":"2024-03-21T00:21:14Z","snapshot_observed_at":"2026-08-02T17:09:20.540788Z","submitted_at":"2023-08-10T06:43:44Z","title":"Trustworthy LLMs: a Survey and Guideline for Evaluating Large Language Models' Alignment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05374","snapshot_observed_at":"2026-08-06T20:12:31.934646Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:31.934646Z"},"links":{"cited_paper":"/paper/2308.05374","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:096f8675da7cf73398e15002c401d795b8f5f709fb1c3e97762d4da30d87e350","observation_id":"4352885e-eeab-4b84-bd8f-08c00e0f0c34","resolution":{"observed_at":"2026-08-06T20:12:31.934646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06824","last_updated":"2024-08-19T01:18:41Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:54:39Z","title":"The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06824","snapshot_observed_at":"2026-08-06T20:12:32.082534Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.082534Z"},"links":{"cited_paper":"/paper/2310.06824","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:51553e206f8dfbbefb71577d092caa954a749f2f833d5d527bb909b41e1b64fe","observation_id":"9295086e-065f-4692-bae0-5645d92b2092","resolution":{"observed_at":"2026-08-06T20:12:32.082534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04984","last_updated":"2025-01-14T20:16:01Z","snapshot_observed_at":"2026-07-29T23:20:20.918596Z","submitted_at":"2024-12-06T12:09:50Z","title":"Frontier Models are Capable of In-context Scheming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04984","snapshot_observed_at":"2026-08-06T20:12:32.170069Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.170069Z"},"links":{"cited_paper":"/paper/2412.04984","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:59812e7c9604823f2b882af054e7b3f16a29b1de3ad6ea88774da732d8d3a10c","observation_id":"89996c97-33f7-4b19-af30-445a6f932ffb","resolution":{"observed_at":"2026-08-06T20:12:32.170069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.100769Z","title":null,"venue":null,"work_id":"ff2cf3a4-e13a-4516-9a0b-d85b5a3c1189","year":2022},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.292132Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:800ffa6f540e1f6b5332a9e371019a2be6300319c2610a72688e8443a3338041","observation_id":"7b2a8d3a-8b9f-4bc4-a50d-dc6304d93ee6","resolution":{"observed_at":"2026-08-06T20:12:33.103446Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09674","last_updated":"2025-05-27T08:40:42Z","snapshot_observed_at":"2026-08-09T02:24:15.276351Z","submitted_at":"2025-02-13T06:39:22Z","title":"The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09674","snapshot_observed_at":"2026-08-06T20:12:32.398404Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.398404Z"},"links":{"cited_paper":"/paper/2502.09674","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:91eba43c4eff2a21d44ca4a8fcd5245bdf91104c6ae358d85f636d871494943b","observation_id":"b416694e-7921-4807-93b9-12890c8c63dc","resolution":{"observed_at":"2026-08-06T20:12:32.398404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.092465Z","title":null,"venue":null,"work_id":"b9bbe134-9c93-4955-b5fd-61e6668e736a","year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.567511Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:5883fc56579265fdafa1e3ef2aa2d7fab1fac1a88813abe1de70d7d755c8dfaa","observation_id":"939f9b4c-eefc-4e53-a938-b2c1c323f77b","resolution":{"observed_at":"2026-08-06T20:12:33.095322Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:32.643003Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.643003Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:456f347cfc5443768d3b21d9aab945b6858e0a13a6f78cfcacec86ec627f95c1","observation_id":"bafb2894-8f73-459c-8955-986e3df6e39a","resolution":{"observed_at":"2026-08-06T20:12:32.643003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15025","last_updated":"2023-09-26T15:49:23Z","snapshot_observed_at":"2026-07-06T16:23:53.247204Z","submitted_at":"2023-09-26T15:49:23Z","title":"Large Language Model Alignment: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15025","snapshot_observed_at":"2026-08-06T20:12:32.681144Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.681144Z"},"links":{"cited_paper":"/paper/2309.15025","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:ba4b67f59d2914a66866dc2df642b8a47ab4923e3a6f580094afcbb43f874c0d","observation_id":"65189b11-ca14-4d88-a6e2-8eccd78c7420","resolution":{"observed_at":"2026-08-06T20:12:32.681144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.078290Z","title":null,"venue":null,"work_id":"f090d180-425a-4372-82d9-9efd2e387c9b","year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.699969Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:7cf3e44ab2206bb02f748305c5bc4fc3def225ec44e4c469ec77c53cc1881dea","observation_id":"9f9a9da4-00a7-4c63-99f1-b22f0e2864bb","resolution":{"observed_at":"2026-08-06T20:12:33.080992Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.069694Z","title":"Zhao, Kelvin Guu, Adams Wei Yu, Brian Lester, Nan Du, Andrew M","venue":null,"work_id":"7aee3291-eb65-485e-a398-1c4c8e53399b","year":2022},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.703259Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:5817901655cbcd9ebac6e48bf63c61f59dd94410747374a57d66494a5cc31551","observation_id":"977ae365-45ac-4b9a-a33d-300974733ea9","resolution":{"observed_at":"2026-08-06T20:12:33.072891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16332","last_updated":"2025-05-27T10:39:39Z","snapshot_observed_at":"2026-08-01T16:40:47.078977Z","submitted_at":"2024-01-29T17:38:14Z","title":"Tradeoffs Between Alignment and Helpfulness in Language Models with Steering Methods","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16332","snapshot_observed_at":"2026-08-06T20:12:32.706277Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.706277Z"},"links":{"cited_paper":"/paper/2401.16332","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:4fd38b7d66688b397722b85ca702c837363ad1008356c7e89b3bace9b2095b07","observation_id":"197cdb0f-11bf-4a8f-b2f3-cdaac7a31d69","resolution":{"observed_at":"2026-08-06T20:12:32.706277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:32.709279Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.709279Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:8c3d298e44f5f22ecd4ac5a59bd1ba4a9b1d4e10a3b7824dfc326019b8d8911f","observation_id":"bdee2e24-4579-4b38-a4bc-fb759751952f","resolution":{"observed_at":"2026-08-06T20:12:32.709279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:32.711845Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.711845Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:4cfd68ce125d1750705bee6d2bf8109189309871087fb3c8b7c1f8b5c31cbaed","observation_id":"21face3e-8415-4880-af1a-fe573448aef9","resolution":{"observed_at":"2026-08-06T20:12:32.711845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:12:33.060118Z","title":null,"venue":null,"work_id":"a3795265-23cc-47f5-8c9a-172726f3075c","year":2024},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.714663Z"},"links":{"citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:f3c72e29b8786e36b99bca107d8c66b02498468a682d506768f705af4bf58776","observation_id":"11ef7507-24b9-4b9b-8132-d4782471ece7","resolution":{"observed_at":"2026-08-06T20:12:33.063688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-06T20:12:32.717267Z","title":"Byun, Zifan Wang, Alex Mallen, Steven Basart, Sanmi Koyejo, Dawn Song, Matt Fredrikson, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T20:12:32.717267Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2507.03662"},"observation_digest":"sha256:f4dc7bc83f4b035894a04ba15d8ccaf08b92df061cc201b66bc6f298b015f254","observation_id":"3798a0a1-33f5-473c-9ba6-a532c6038529","resolution":{"observed_at":"2026-08-06T20:12:32.717267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.03662","last_updated":"2025-07-04T15:36:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T02:24:37.760148Z","submitted_at":"2025-07-04T15:36:58Z","title":"Re-Emergent Misalignment: How Narrow Fine-Tuning Erodes Safety Alignment in LLMs"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 6 inbound Pith citation observations for arXiv:2507.03662."}