{"as_of":"2026-08-24T04:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d344b35c69cea7274b2d75d962b92e6cb0d153ab7e385c6c21bad3194dfa567e","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T20:39:58.726973Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T11:26:55.810822Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"cited_work":{"arxiv_id":"2511.19558","doi":"10.48550/arxiv.2511.19558","metadata_source":"arxiv_reference","pith_arxiv_id":"2511.19558","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , journal =","venue":"arXiv (Cornell University)","work_id":"3705245a-c31f-443e-9724-eed641c328ab","year":2025},"citing_paper":{"arxiv_id":"2604.21041","last_updated":"2026-04-22T19:39:56Z","snapshot_observed_at":"2026-07-06T23:07:41.856444Z","submitted_at":"2026-04-22T19:39:56Z","title":"Projected Gradient Unlearning for Text-to-Image Diffusion Models: Defending Against Concept Revival Attacks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T00:01:14.282766Z"},"links":{"cited_paper":"/paper/2511.19558","citing_paper":"/paper/2604.21041"},"observation_digest":"sha256:685ec3ccc9727481a9fe85360519588b9e84f74c285d92a66ddd529ae7aeb77b","observation_id":"307a12bd-bf81-4a06-8c05-07eb4189f489","resolution":{"observed_at":"2026-07-14T02:20:20.283959Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-20T21:54:52.640614+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T21:54:52.640614+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"cited_work":{"arxiv_id":"2511.19558","doi":"10.48550/arxiv.2511.19558","metadata_source":"arxiv_reference","pith_arxiv_id":"2511.19558","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2025 , journal =","venue":"arXiv (Cornell University)","work_id":"3705245a-c31f-443e-9724-eed641c328ab","year":2025},"citing_paper":{"arxiv_id":"2605.18719","last_updated":"2026-05-18T17:50:04Z","snapshot_observed_at":"2026-08-14T23:49:25.363918Z","submitted_at":"2026-05-18T17:50:04Z","title":"SafeDiffusion-R1: Online Reward Steering for Safe Diffusion Post-Training","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-05-20T11:26:55.810822Z"},"links":{"cited_paper":"/paper/2511.19558","citing_paper":"/paper/2605.18719"},"observation_digest":"sha256:2be80c862e16ab9e964aeecbdaf9d44545904758050bf4abe2e554d69dca578f","observation_id":"6b87137f-5c04-4a71-8b61-568e350f0914","resolution":{"observed_at":"2026-07-14T02:20:20.283959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-05-20T21:54:52.640614+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T21:54:52.640614+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2511.19558/citation-record","integrity":"/paper/2511.19558/integrity","json":"/paper/2511.19558/citation-record.json","paper":"/paper/2511.19558"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-03T20:39:53.317945Z","title":"Qwen-image technical re- port.arXiv preprint arXiv:2508.02324, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:53.317945Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:0e57867d80d7c66d3c5086e9111f6086fcdc322a970214c0ade1cc15b100dfb7","observation_id":"899e252d-72c6-4dee-aa1c-76b7371048fb","resolution":{"observed_at":"2026-08-03T20:39:53.317945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:53.401521Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:53.401521Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:1d160cec19c371997cfb9ab03a1c8acc4d57489c83d008ed21a22d8698c9ebf7","observation_id":"51e926e9-ec78-49bf-bfe2-311d3ce6bcdc","resolution":{"observed_at":"2026-08-03T20:39:53.401521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:53.493367Z","title":"Safe latent diffusion: Mitigat- ing inappropriate degeneration in diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:53.493367Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:bd967c54787896a8fc1e19188574cc72320731c4b92482ee4fe3d05d2c69e07e","observation_id":"3b49f4c2-ae40-4687-9f7c-c81ab49de5d6","resolution":{"observed_at":"2026-08-03T20:39:53.493367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:53.597373Z","title":"Extracting training data from diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:53.597373Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:2a23c5deae73e4deeb419c5eae96776b46e48aa04b4d66be1cfb046887629838","observation_id":"eb7ab05f-eb70-4ae7-bc9d-c86c5dba3377","resolution":{"observed_at":"2026-08-03T20:39:53.597373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:53.701442Z","title":"Understanding and mitigating copying in diffusion models.NeurIPS, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:53.701442Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:90ed604e1271bade83b946854876868fe3cacb5dbec0ea11ce52dcaba48f5d4f","observation_id":"32c9cb6b-a9d1-490d-9139-8497229fd798","resolution":{"observed_at":"2026-08-03T20:39:53.701442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18566","last_updated":"2024-06-01T15:47:13Z","snapshot_observed_at":"2026-08-16T13:47:08.746620Z","submitted_at":"2024-06-01T15:47:13Z","title":"Memorized Images in Diffusion Models share a Subspace that can be Located and Deleted","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18566","snapshot_observed_at":"2026-08-03T20:39:53.817572Z","title":"Memorized images in diffusion models share a subspace that can be located and deleted.arXiv preprint arXiv:2406.18566, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:53.817572Z"},"links":{"cited_paper":"/paper/2406.18566","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:201755ec0b71da86439cdd5a4a97ce7313f02a2c66605462ab0d8daff1f37a91","observation_id":"98fa3c51-6eab-4d46-b9ed-ba0b924bc015","resolution":{"observed_at":"2026-08-03T20:39:53.817572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:53.933718Z","title":"Latent guard: a safety framework for text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:53.933718Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:4620381ce99b9a16bfc5ed18ecca2175dd945df6deb56e8628f8125fc3988af1","observation_id":"ea094162-9b9e-480a-bc15-957a3bf3109d","resolution":{"observed_at":"2026-08-03T20:39:53.933718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:54.043022Z","title":"Unsafe diffusion: On the generation of unsafe images and hateful memes from text-to-image models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:54.043022Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:82e7bf8ca7855fbb920ccdf31c5cd578f74b46cc9ef658ab4da95ef0865eb31f","observation_id":"5cea8bd9-3def-4341-9a51-c661a47edae4","resolution":{"observed_at":"2026-08-03T20:39:54.043022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:54.116877Z","title":"Safe vision- language models via unsafe weights manipulation.arXiv preprint arXiv:2503.11742, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:54.116877Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:cef38d0cbebf2245db29638b6d6bf7e2fb5d89a79045ed693d6e0f21d519c2ca","observation_id":"b63d3fca-2132-4e5e-bf0a-89afb04501d0","resolution":{"observed_at":"2026-08-03T20:39:54.116877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:54.275274Z","title":"Safe- clip: Removing nsfw concepts from vision-and-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:54.275274Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:0887c36277c366d9d5b5b2a3befd79b31d65aa78ffd83d392963535b5d950118","observation_id":"21840955-369a-45b7-aa15-c30b1ecbe48b","resolution":{"observed_at":"2026-08-03T20:39:54.275274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:54.381061Z","title":"Reliable and efficient concept erasure of text-to-image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:54.381061Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:aacd5eca27b4eeb17160c826776469750cf9b39e885dff7de37495a9bd81195b","observation_id":"7209ebe8-bdc9-4293-9377-e9cd06cd980c","resolution":{"observed_at":"2026-08-03T20:39:54.381061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:54.497555Z","title":"Mace: Mass concept erasure in diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:54.497555Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:24d756e1291477160eb18553637d49e88b23df443e69c7949e14a23a921f7f60","observation_id":"358932ad-b8e5-472f-af79-495abbe31592","resolution":{"observed_at":"2026-08-03T20:39:54.497555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12508","last_updated":"2024-04-04T07:45:38Z","snapshot_observed_at":"2026-08-03T17:30:25.153454Z","submitted_at":"2023-10-19T06:17:17Z","title":"SalUn: Empowering Machine Unlearning via Gradient-based Weight Saliency in Both Image Classification and Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12508","snapshot_observed_at":"2026-08-03T20:39:54.587810Z","title":"Salun: Empowering ma- chine unlearning via gradient-based weight saliency in both image classification and generation.arXiv preprint arXiv:2310.12508, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:54.587810Z"},"links":{"cited_paper":"/paper/2310.12508","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:628aa135dcd7e03f70a05f93da3a483f454737a6f32d2980b65d9e383a756bb8","observation_id":"138f989b-214f-4398-85a7-9ab97ef6366c","resolution":{"observed_at":"2026-08-03T20:39:54.587810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:54.693866Z","title":"Scissorhands: Scrub data influence via connection sensitivity in networks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:54.693866Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:975b2b77cbbd68bb4f63a1155e11f1e6e7b937c586e4eb5eb4d3cb0ebef13787","observation_id":"36fda920-84e9-4d87-b73b-c48bb3415370","resolution":{"observed_at":"2026-08-03T20:39:54.693866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:54.851780Z","title":"Erasing undesirable influence in diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:54.851780Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:ab9d807614db051ccb390448cb740ba9580f5bb02fa5a1c6ceaa000294095bbd","observation_id":"0cc03dcc-d476-498f-9fe9-64c8fada524a","resolution":{"observed_at":"2026-08-03T20:39:54.851780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:54.964013Z","title":"Erasing concepts from dif- fusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:54.964013Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:6dda41eed670743326c21f23639aa6fc90bcb5a61aa401034f69b77557a1aac8","observation_id":"ce980f7e-f285-4ddb-a93d-1b3120abcbb3","resolution":{"observed_at":"2026-08-03T20:39:54.964013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:55.080233Z","title":"Stereo: Towards adversari- ally robust concept erasing from text-to-image genera- tion models.arXiv e-prints, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:55.080233Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:801025a70c0821407854fc39435228db2e160cf8023c7987f20c95bfac5e1e53","observation_id":"d38f9121-287e-479e-b8b9-c1b97febbb56","resolution":{"observed_at":"2026-08-03T20:39:55.080233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10012","last_updated":"2024-06-07T02:48:59Z","snapshot_observed_at":"2026-08-17T22:33:59.558537Z","submitted_at":"2023-10-16T02:11:20Z","title":"Ring-A-Bell! How Reliable are Concept Removal Methods for Diffusion Models?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10012","snapshot_observed_at":"2026-08-03T20:39:55.186965Z","title":"Ring-a-bell! how reliable are concept removal methods for diffusion models?arXiv preprint arXiv:2310.10012, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:55.186965Z"},"links":{"cited_paper":"/paper/2310.10012","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:9f02f831ca45efe5909bc46d042a1ab3682d198564f972c301fd6d8782b62bab","observation_id":"ab87e50c-307c-44d1-b797-981524aba118","resolution":{"observed_at":"2026-08-03T20:39:55.186965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:55.302835Z","title":"Sneakyprompt: Jailbreaking text-to-image generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:55.302835Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:8ee403c8b598eca874bc5aea89f694ec4ac237da38565ec9779fa5fcfbf18d1a","observation_id":"043b3518-5053-4726-90d4-e67d4e98b8de","resolution":{"observed_at":"2026-08-03T20:39:55.302835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:55.388634Z","title":"Modifier unlocked: Jailbreaking text-to-image models through prompts","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:55.388634Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:091669d260716f38457bae2fdd518cbca35d7546552cdae8dedbe8b98a9ba883","observation_id":"47408859-aa80-4eee-be67-b19190f44287","resolution":{"observed_at":"2026-08-03T20:39:55.388634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:55.492965Z","title":"Jailbreaking prompt attack: A controllable adversarial attack against diffu- sion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:55.492965Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:5b499a24887ea7a0b47907739d03f30afc6fd7550bfcb6c8207cc22ce7c7a1ff","observation_id":"471cd9c5-bb72-4b05-8d50-054b66eaa6ce","resolution":{"observed_at":"2026-08-03T20:39:55.492965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:55.666658Z","title":"The illusion of unlearning: The unstable nature of machine unlearning in text-to-image diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:55.666658Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:fcec024e891c3425a9aeef170290253122ec7e34ed8535e502269afe31704b5c","observation_id":"e72f6d2a-f4b9-4870-b2f8-3ffa200568f2","resolution":{"observed_at":"2026-08-03T20:39:55.666658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:55.731434Z","title":"Unstable un- learning: The hidden risk of concept resurgence in diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:55.731434Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:f885486c3e0463b13f82d2f336e45aa85e5aaf98a2cf9517e809ee2a0b8e8714","observation_id":"f3cd0aae-cb09-4903-a31c-6e4405f1b0fe","resolution":{"observed_at":"2026-08-03T20:39:55.731434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:55.752088Z","title":"To- wards resilient safety-driven unlearning for diffusion models against downstream fine-tuning.arXiv preprint arXiv:2507.16302, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:55.752088Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:0877d2521272e8dc8cadeb17ad2bae681caecc25f33ad0e5ed198c5e3b4eec3b","observation_id":"e34a4be4-d1ee-40b2-8047-61862c5b419a","resolution":{"observed_at":"2026-08-03T20:39:55.752088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:55.887263Z","title":"Lora: Low-rank adaptation of large language mod- els.ICLR, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:55.887263Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:8bf5028b8d92637446c63599f375b98a9c6ae888b385566573eac3f3eaf17546","observation_id":"f24228a7-98d0-4ec1-a971-e30311de1ec0","resolution":{"observed_at":"2026-08-03T20:39:55.887263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:56.037195Z","title":"Forget-me-not: Learning to forget in text-to-image diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:56.037195Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:8cf137cbc04643cae59285652d326137ca7addc270e622169e4bd99cea3e07b7","observation_id":"30d7bcaa-4253-4036-97eb-55afb8a36dad","resolution":{"observed_at":"2026-08-03T20:39:56.037195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:56.194679Z","title":"Defensive unlearning with adversarial training for robust concept erasure in diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:56.194679Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:7eebcb810d77c1e8b11b1d8d45bed530f9679c9c16b984fda5a9061cba7d76b4","observation_id":"ce310a91-53b3-49d5-af48-be22babd914c","resolution":{"observed_at":"2026-08-03T20:39:56.194679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:56.281329Z","title":"One-dimensional adapter to rule them all: Concepts diffusion models and erasing applications","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:56.281329Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:a9cd76f28912a752eab796d2e18a0c229467bf43e96a1d67f16652c64605a9d9","observation_id":"db0c6de9-0cd2-4b6c-bffa-77c2cb52b508","resolution":{"observed_at":"2026-08-03T20:39:56.281329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:56.436188Z","title":"Unified con- cept editing in diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:56.436188Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:6b000a89ecb8a6de8f88f9dc61e0c75ca5fcf83bc7729aae5b89f55f5739c913","observation_id":"0a91a6d4-7109-4d00-bee2-4dcac8f2022a","resolution":{"observed_at":"2026-08-03T20:39:56.436188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:56.603169Z","title":"Learning transferable visual models from natural lan- guage supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:56.603169Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:c518b1c5d5977a96442df0cffdb87f246101078fc4e56d9f4621b5ac81d483fc","observation_id":"ed4dde46-1128-49aa-90bb-18dbef7dc171","resolution":{"observed_at":"2026-08-03T20:39:56.603169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:56.698780Z","title":"Unlearning vision trans- formers without retaining data via low-rank decomposi- tions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:56.698780Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:b51457dbc227caa9f4e9c0e4aca9e3b35bd60da8ee81a2478e8d3044cb8c30f1","observation_id":"0b9bfb1d-7dc5-4131-8c28-9bc6d879e655","resolution":{"observed_at":"2026-08-03T20:39:56.698780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-03T20:39:56.807456Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and ro- bust refusal.arXiv preprint arXiv:2402.04249, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:56.807456Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:4be1a70a3d473f4666459d4b86a01bbd87c8b774ef2a3bca7d9b71b156bb9b23","observation_id":"b5110894-ce44-4278-95c7-68acfb5e4dd5","resolution":{"observed_at":"2026-08-03T20:39:56.807456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:56.981025Z","title":"Beavertails: Towards im- proved safety alignment of llm via a human-preference dataset.NeurIPS, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:56.981025Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:48b4fece067d2417e2bfa0c577baea2381f4021b1c54235379a89ee0be46dfa3","observation_id":"e57bec4c-a0e9-4550-99d4-5656afd8cd40","resolution":{"observed_at":"2026-08-03T20:39:56.981025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:57.093019Z","title":"To- wards understanding the fragility of multilingual llms against fine-tuning attacks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:57.093019Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:d3e31d3c4e9da776f0d41e1601a7d9cda182e585c598c139adef0c647962250b","observation_id":"64e3bf64-57c2-42e5-8edb-99edc97f3b16","resolution":{"observed_at":"2026-08-03T20:39:57.093019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11846","last_updated":"2024-10-29T18:36:06Z","snapshot_observed_at":"2026-08-16T20:56:27.013678Z","submitted_at":"2024-02-19T05:25:53Z","title":"UnlearnCanvas: Stylized Image Dataset for Enhanced Machine Unlearning Evaluation in Diffusion Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11846","snapshot_observed_at":"2026-08-03T20:39:57.158834Z","title":"Unlearncanvas: Stylized image dataset for en- hanced machine unlearning evaluation in diffusion mod- els.arXiv preprint arXiv:2402.11846, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:57.158834Z"},"links":{"cited_paper":"/paper/2402.11846","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:e079141cdfabfc403d61d044be607ec3278338bb427108aab9441ef4f4bd246b","observation_id":"71bbf285-6a37-4ee9-b441-c0f8fcb9f5b1","resolution":{"observed_at":"2026-08-03T20:39:57.158834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:57.294712Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:57.294712Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:adda0d20fd3c2d0c745b474804e2b9d5d7d073c68a1966abb7316fd45f75019d","observation_id":"0f074efa-4383-472e-9821-b3c109e6fc1c","resolution":{"observed_at":"2026-08-03T20:39:57.294712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:57.440105Z","title":"Nudenet: Nsfw object detection for tfjs and nodejs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:57.440105Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:992a1a9a8af75418deb3bcea0be77161b57c05f05cbcc667da5fa8eeeed4d0dc","observation_id":"bcb84d93-b875-4e9f-999d-a00e95bfe264","resolution":{"observed_at":"2026-08-03T20:39:57.440105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.03486","last_updated":"2025-09-11T08:50:08Z","snapshot_observed_at":"2026-08-19T06:38:35.370166Z","submitted_at":"2024-05-06T13:57:03Z","title":"UnsafeBench: Benchmarking Image Safety Classifiers on Real-World and AI-Generated Images","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.03486","snapshot_observed_at":"2026-08-03T20:39:57.598200Z","title":"Unsafebench: Benchmarking image safety classifiers on real-world and ai-generated images.arXiv preprint arXiv:2405.03486,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:57.598200Z"},"links":{"cited_paper":"/paper/2405.03486","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:c020b3e44f2c6b83febed555435a041f51e3f6044832dbfcaf92841527e65db7","observation_id":"a781b074-3156-48d9-8cff-35e35bdff06a","resolution":{"observed_at":"2026-08-03T20:39:57.598200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05448","last_updated":"2024-03-03T10:02:54Z","snapshot_observed_at":"2026-08-16T14:20:21.022530Z","submitted_at":"2024-02-08T07:01:00Z","title":"Minecraft-ify: Minecraft Style Image Generation with Text-guided Image Editing for In-Game Application","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05448","snapshot_observed_at":"2026-08-03T20:39:57.721994Z","title":"The false sense of safety in ai: Poisoning and behav- ior manipulation via benign fine-tuning.arXiv preprint arXiv:2402.05448, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:57.721994Z"},"links":{"cited_paper":"/paper/2402.05448","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:511eb8f71e7bf1b2bf1ead748e06ba9528b9a81a987a2dd328d6948c5e59b029","observation_id":"277741e1-2ec0-4d20-b101-a6e60fa24eff","resolution":{"observed_at":"2026-08-03T20:39:57.721994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:57.892600Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:57.892600Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:b1db9f98c58113b9b908be15ab477396c0bb630def6446a640723a3591345fa6","observation_id":"e00af068-3178-4302-b12a-73abe2793417","resolution":{"observed_at":"2026-08-03T20:39:57.892600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12527","last_updated":"2025-02-18T04:25:42Z","snapshot_observed_at":"2026-08-17T14:04:07.109233Z","submitted_at":"2025-02-18T04:25:42Z","title":"Comprehensive Assessment and Analysis for NSFW Content Erasure in Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12527","snapshot_observed_at":"2026-08-03T20:39:58.047828Z","title":"Comprehensive assessment and analysis for nsfw content erasure in text-to-image diffusion models.arXiv preprint arXiv:2502.12527, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:58.047828Z"},"links":{"cited_paper":"/paper/2502.12527","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:4185424e549ecf752f130df0245db48a00bfc9dcb66bed7d468fa84d61de4c91","observation_id":"13ffa646-b567-4b33-b85a-3de467baccd4","resolution":{"observed_at":"2026-08-03T20:39:58.047828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:58.218610Z","title":"T2isafety: Benchmark for assessing fairness, toxicity, and privacy in image generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:58.218610Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:43f90179a461457eb227d4dc02c9e57d33353262be68e7593151905dee3308f2","observation_id":"560b3410-c583-43f3-87c6-425c0ef0c123","resolution":{"observed_at":"2026-08-03T20:39:58.218610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:58.383536Z","title":"Stable diffusion 2.1 release notes.https: //stability.ai/blog/stable-diffusion- 2-1-release, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:58.383536Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:be17eed01ce8b078357adb07d6a67accdb8a95a89b65a7878aaa888b163c1d2e","observation_id":"4c6e4b86-f150-43cc-ac2b-36cedc883146","resolution":{"observed_at":"2026-08-03T20:39:58.383536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:58.519470Z","title":"Nih chest x-ray dataset.https://www.kaggle.com/datasets/ nih-chest-xrays/data, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:58.519470Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:f6a72f83dd606bf35c5e6df24365e1cb9fbe5739069e0da34d53badf14368b43","observation_id":"39081c2a-2220-41ad-8856-dbb8f609bd60","resolution":{"observed_at":"2026-08-03T20:39:58.519470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:58.586941Z","title":"Brain tumor mri dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:58.586941Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:3dc31bd8c0e3215d928382ab0d33fb4863809a4fa4f740a1eaefa0d9712f636f","observation_id":"de0708e8-8f03-417d-b0e7-4630e5ef730e","resolution":{"observed_at":"2026-08-03T20:39:58.586941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:39:58.671368Z","title":"Stable diffusion 2.1 release notes.https: //stability.ai/blog/stable-diffusion- 2-1-release, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:58.671368Z"},"links":{"citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:b93a876c715830d95ab2ea2f52dd9556d7147c1809ab7dd9c44dc97561434b0c","observation_id":"68526b1a-7ed8-437e-9f4f-19c6adc50b0e","resolution":{"observed_at":"2026-08-03T20:39:58.671368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-03T20:39:58.726973Z","title":"Silent Safety Failure","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T20:39:58.726973Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2511.19558"},"observation_digest":"sha256:a459c997ced0ee20fcda3c5568285af315d8a2b7d8c3afb9f759cb108efccf3c","observation_id":"356ae770-f4e1-4225-9520-3c6c6b384dbb","resolution":{"observed_at":"2026-08-03T20:39:58.726973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.19558","last_updated":"2026-07-11T23:36:07Z","latest_version":2,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-16T12:47:34.255303Z","submitted_at":"2025-11-24T14:46:20Z","title":"SPQR: A Multi-Dimensional Benchmark for Safety Alignment under Benign Model Adaptation"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2511.19558."}