{"as_of":"2026-08-07T23:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:46b8e38a279829002fc098ae4456fd7c62e43d314a1f45fadb01af5d70271cf7","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:27:47.482807Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02442/citation-record","integrity":"/paper/2506.02442/integrity","json":"/paper/2506.02442/citation-record.json","paper":"/paper/2506.02442"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:27:47.122877Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.122877Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:95f2748c883f8b8f2c30ca361c78dfd4c489c0b31c9073198cc922a8aebb202f","observation_id":"4f626177-35eb-4ab9-bd5b-a0c7274a307b","resolution":{"observed_at":"2026-08-07T11:27:47.122877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:50.173620Z","title":null,"venue":null,"work_id":"d297f7be-e1e4-4209-a9c2-cf9de5ea4733","year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.129536Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:a96efedba868e895d89f5a7a472e3cc9aef68eff04d9da1a64b5daf1587f3d12","observation_id":"52404c4d-5d6a-471e-a625-cda4dadbb19f","resolution":{"observed_at":"2026-08-07T11:27:50.178348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14132","last_updated":"2023-11-07T03:30:15Z","snapshot_observed_at":"2026-07-06T16:10:54.723336Z","submitted_at":"2023-08-27T15:20:06Z","title":"Detecting Language Model Attacks with Perplexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14132","snapshot_observed_at":"2026-08-07T11:27:47.137122Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.137122Z"},"links":{"cited_paper":"/paper/2308.14132","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:92a688411ea0b6af93f38ea2bbec34033557076877c1c035f5b2c4b6c3c5bd65","observation_id":"ae55402e-b8c8-4b91-8a4b-b978302c4afb","resolution":{"observed_at":"2026-08-07T11:27:47.137122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T11:27:47.144854Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.144854Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:5637eb93bf795ca936c99253bb5c080b65b23052105034856c4364f89a44133e","observation_id":"04624ff3-35b9-404b-ab65-c8b96582c804","resolution":{"observed_at":"2026-08-07T11:27:47.144854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.985889Z","title":null,"venue":null,"work_id":"ebc43177-265d-4090-95cd-63141a6667d6","year":2021},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.152801Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:394d9aa4b895d5f05013f56f2fc862623b6816f321f24dd32077eec45d47dcb1","observation_id":"cc9f277e-c466-46c5-ac76-a412e39331ef","resolution":{"observed_at":"2026-08-07T11:27:50.095009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11445","last_updated":"2024-11-05T08:46:01Z","snapshot_observed_at":"2026-07-06T19:17:02.745056Z","submitted_at":"2024-09-17T03:39:45Z","title":"Jailbreaking Large Language Models with Symbolic Mathematics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11445","snapshot_observed_at":"2026-08-07T11:27:47.159009Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.159009Z"},"links":{"cited_paper":"/paper/2409.11445","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:46ace10d1959984d3a98e07f38e125fcd1dc0573ab21b8337087903474c24120","observation_id":"a2c1901f-66e2-4c83-a48e-6db1d4fb6c5c","resolution":{"observed_at":"2026-08-07T11:27:47.159009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.166556Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.166556Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:ccf54aed8ca87b74a3c8db82020c4eb1e11daf76722c18ebf307acb7edc6aac2","observation_id":"f11eae64-55f7-45ac-b29d-bf93198671f2","resolution":{"observed_at":"2026-08-07T11:27:47.166556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.865862Z","title":"Pappas, Florian Tram\\` e r, Hamed Hassani, and Eric Wong","venue":null,"work_id":"cb0e6cc7-a751-4a77-9cde-ad785a64f8a6","year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.175424Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:c5d9cad57276d50f4b50032d1328625c18476eee1a27c93d64e3a8e6f22a7199","observation_id":"bbb14b9f-4929-4411-a53d-120cf8f8b928","resolution":{"observed_at":"2026-08-07T11:27:49.928300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.709436Z","title":"Pappas, Florian Tram \\`e r, Hamed Hassani, and Eric Wong","venue":null,"work_id":"104ea033-26e6-4039-9c41-b8fcf2d56c1a","year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.182198Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:311d7779d35d2b32e7b5704fc3ae84ef8c717bcdde5721af99cccaaf47a85d1e","observation_id":"c43bbd36-f338-4770-bffb-980105f6b432","resolution":{"observed_at":"2026-08-07T11:27:49.777409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03274","last_updated":"2024-12-02T08:53:40Z","snapshot_observed_at":"2026-08-02T08:56:14.285582Z","submitted_at":"2024-09-05T06:31:37Z","title":"Recent Advances in Attack and Defense Approaches of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03274","snapshot_observed_at":"2026-08-07T11:27:47.188977Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.188977Z"},"links":{"cited_paper":"/paper/2409.03274","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:4ae4967cfcab2539f8b4a7b8ac90c269dceebab19645c29bfc8c5a48d34eb266","observation_id":"3ecfed4b-90af-4563-bbef-b163fb4546b3","resolution":{"observed_at":"2026-08-07T11:27:47.188977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09283","last_updated":"2024-03-27T13:55:14Z","snapshot_observed_at":"2026-07-06T17:30:08.206972Z","submitted_at":"2024-02-14T16:14:03Z","title":"Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09283","snapshot_observed_at":"2026-08-07T11:27:47.195714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.195714Z"},"links":{"cited_paper":"/paper/2402.09283","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:3f10e46d5b1121cbf480b99758b4aeb37009c5bd6ec1c8da47750ea6711b259a","observation_id":"5ca62124-816a-4f1f-9737-e4b7ec72e693","resolution":{"observed_at":"2026-08-07T11:27:47.195714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-67485-3","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.631543Z","title":null,"venue":null,"work_id":"cac04733-5046-4581-8398-e6beb376aa6b","year":2018},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.204744Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:e37f1cb49923866c2b2dec184e06ba2445c19be7835ebbe0aa44ed1ef5dff154","observation_id":"c6b7078e-91a8-422d-af32-06c9c369cce8","resolution":{"observed_at":"2026-08-07T11:27:47.649065Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.583323Z","title":null,"venue":null,"work_id":"251521a5-97a0-47d9-b178-61106d00f76d","year":2019},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.213100Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:618c77dc114a3ac3a444eb5779a88a16f71d6612020ca0687b5e635a20a6d9b8","observation_id":"72ae24e7-ab71-481b-9ca2-3158ebd550e2","resolution":{"observed_at":"2026-08-07T11:27:49.647650Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.04883","last_updated":"2018-01-15T17:32:04Z","snapshot_observed_at":"2026-08-01T20:21:10.276565Z","submitted_at":"2018-01-15T17:32:04Z","title":"Unsupervised Cipher Cracking Using Discrete GANs","version":1},"cited_work":{"arxiv_id":"1801.04883","doi":null,"metadata_source":"pith","pith_arxiv_id":"1801.04883","snapshot_observed_at":"2026-08-07T11:27:48.610565Z","title":"Unsupervised Cipher Cracking Using Discrete GANs","venue":"cs.LG","work_id":"ea3ac51e-d58e-4503-9acf-60bc26b8dc3b","year":2018},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.227011Z"},"links":{"cited_paper":"/paper/1801.04883","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:e4d77cd9d44f8fd6f98e195ac1d3c7ec2c036cd24ac53c620e14b464c7d17c3f","observation_id":"88b1e8b6-d140-46b4-a892-d0a8b718f7a3","resolution":{"observed_at":"2026-08-07T11:27:48.698390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T11:27:47.235852Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.235852Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:b386760157714ae99a1b3b36b549ea04517d7cccb14cf3bc6e8563eba96138ed","observation_id":"30ab4d27-9b68-4ebd-98b4-569097c9ddc8","resolution":{"observed_at":"2026-08-07T11:27:47.235852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.476853Z","title":null,"venue":null,"work_id":"d5c32c68-b38d-424f-afbf-9be00e4500bd","year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.242254Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:78aa2bc704923fa37bdfdb27b7ec598c24fc017f6ace4292a2e1dca510d46aa0","observation_id":"567d72f0-94fd-42bf-9c2d-ba662c14ee19","resolution":{"observed_at":"2026-08-07T11:27:49.501436Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.250751Z","title":"competency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.250751Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:94b1ad78b2738a05bb524dd1efe59f8e40f905b4177ed5f25e2489676a5dff25","observation_id":"b07cb090-4083-40a9-ae2b-5094165514ae","resolution":{"observed_at":"2026-08-07T11:27:47.250751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.259907Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.259907Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:38874080d626668088329dc09cdca0ead3d3717ab4ab4f3d431ec1ee661e5fba","observation_id":"f21550f7-2f32-4419-af9e-5c182045b666","resolution":{"observed_at":"2026-08-07T11:27:47.259907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01294","last_updated":"2025-05-10T19:38:13Z","snapshot_observed_at":"2026-07-06T19:25:42.156795Z","submitted_at":"2024-10-02T07:40:56Z","title":"Endless Jailbreaks with Bijection Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01294","snapshot_observed_at":"2026-08-07T11:27:47.272740Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.272740Z"},"links":{"cited_paper":"/paper/2410.01294","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:e22e1f18d9f886e360e8a856889cfc33172e722705dd7fef5f14972daeb00cc1","observation_id":"5444761c-5f45-403b-93b7-032d835e6c19","resolution":{"observed_at":"2026-08-07T11:27:47.272740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T11:27:47.280600Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.280600Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:c1e1712d28b967077967d3d36a894111fbe1c3d69783afe81c9719d6482d9e90","observation_id":"88b28cec-7931-4bd0-ab13-fd3bf806ad74","resolution":{"observed_at":"2026-08-07T11:27:47.280600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-07T11:27:47.286452Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.286452Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:c756f1197801b8582cf553572374235db4c9ec48f827d374c3408ea78895e889","observation_id":"d449b9ff-6312-494c-9fce-64e26117404f","resolution":{"observed_at":"2026-08-07T11:27:47.286452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T11:27:47.295083Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.295083Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:d059954b5f4a50a3e940c88bffa9c8d62af2c3c8d032978092a914a816e66925","observation_id":"73344d01-9c0e-4c79-b7c9-733d12031035","resolution":{"observed_at":"2026-08-07T11:27:47.295083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11753","last_updated":"2024-06-07T17:35:17Z","snapshot_observed_at":"2026-07-06T17:31:58.268105Z","submitted_at":"2024-02-19T00:43:31Z","title":"ArtPrompt: ASCII Art-based Jailbreak Attacks against Aligned LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11753","snapshot_observed_at":"2026-08-07T11:27:47.302318Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.302318Z"},"links":{"cited_paper":"/paper/2402.11753","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:eb0d718273b18bf08ec3bad47949b945e1f8c749adfd1dab8fddaf1ee1755116","observation_id":"7093f919-ff68-48f4-8443-7131b57c8455","resolution":{"observed_at":"2026-08-07T11:27:47.302318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.310189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.310189Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:1a0f068811419a538c73bbaa5bf2a1ead8020e1184bae377f401bbd8be69863e","observation_id":"d5aaf8e2-e118-45dc-a18d-0d865ef72af0","resolution":{"observed_at":"2026-08-07T11:27:47.310189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19093","last_updated":"2025-04-27T03:41:17Z","snapshot_observed_at":"2026-08-07T15:58:53.969652Z","submitted_at":"2025-04-27T03:41:17Z","title":"CipherBank: Exploring the Boundary of LLM Reasoning Capabilities through Cryptography Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19093","snapshot_observed_at":"2026-08-07T11:27:47.317124Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.317124Z"},"links":{"cited_paper":"/paper/2504.19093","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:5d4d443a9d313f391da51eb42e9f1bbe7494b36f1b04c4116354252ba151a553","observation_id":"25be7c48-77af-4c52-8fb1-e932c0bf2cd7","resolution":{"observed_at":"2026-08-07T11:27:47.317124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-07T11:27:47.325604Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.325604Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:a819dac45d32fa0bfc461997ab7e847e2c17dfcb6b6ed9f856239d354bf39fc3","observation_id":"d3919f68-8a83-4a68-bfdd-33df43cb7dea","resolution":{"observed_at":"2026-08-07T11:27:47.325604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16717","last_updated":"2024-02-26T16:35:59Z","snapshot_observed_at":"2026-07-06T17:35:36.900600Z","submitted_at":"2024-02-26T16:35:59Z","title":"CodeChameleon: Personalized Encryption Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16717","snapshot_observed_at":"2026-08-07T11:27:47.338065Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.338065Z"},"links":{"cited_paper":"/paper/2402.16717","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:6eca77ba51992cb2e40bbe9265d50f616ca7aff4b1483ce6126d62be87a5f3a1","observation_id":"b091d066-6201-4946-a08c-2e603dcaceda","resolution":{"observed_at":"2026-08-07T11:27:47.338065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24621","last_updated":"2026-05-31T10:26:22Z","snapshot_observed_at":"2026-08-07T12:14:32.510041Z","submitted_at":"2025-05-30T14:12:07Z","title":"Benchmarking Large Language Models for Cryptanalysis and Side-Channel Vulnerabilities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24621","snapshot_observed_at":"2026-08-07T11:27:47.346115Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.346115Z"},"links":{"cited_paper":"/paper/2505.24621","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:e1991f87a7db8ca80e35687fa4e4bef6882b2dff05c4365bb9927c77c8270da3","observation_id":"642d42cb-e567-4d53-81b7-f1669b2ff556","resolution":{"observed_at":"2026-08-07T11:27:47.346115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.09420","last_updated":"2025-04-13T03:36:06Z","snapshot_observed_at":"2026-08-07T16:06:13.556404Z","submitted_at":"2025-04-13T03:36:06Z","title":"SaRO: Enhancing LLM Safety through Reasoning-based Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.09420","snapshot_observed_at":"2026-08-07T11:27:47.354047Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.354047Z"},"links":{"cited_paper":"/paper/2504.09420","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:f16a98f0cfab6f98f28294b57541a171481d040c7ca7365daef037e5804608ca","observation_id":"855c9b16-6bc5-494d-a596-913432d3e6df","resolution":{"observed_at":"2026-08-07T11:27:47.354047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.14301","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:48.069365Z","title":null,"venue":null,"work_id":"9ed213c4-ed6e-4c70-9204-a8adfb311836","year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.369437Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:123ec0d19e5d7422a8f96712d7d1cb6568ff563ddfd7aad939ec1cf2b7c09fa5","observation_id":"e83d5f35-8bbc-474d-88e1-43945ded8fd0","resolution":{"observed_at":"2026-08-07T11:27:48.173546Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.375342Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.375342Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:5294b7530dfc13cfcab1964a62970fda71c2e7dd612dc0b40d6a979771572f44","observation_id":"e64ce843-07d1-48f9-a367-3428c3f2529b","resolution":{"observed_at":"2026-08-07T11:27:47.375342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.381480Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.381480Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:b4a9a67adbd8a8db432770691fcd81203c66e082a00210966f77fa68e990248d","observation_id":"ccd256c9-e1ec-46b8-ada0-20f9e9743acd","resolution":{"observed_at":"2026-08-07T11:27:47.381480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.325016Z","title":null,"venue":null,"work_id":"d748205a-0cb9-45fb-902f-a1e1a157fcf8","year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.386841Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:bb5e0b8a966ceb749a2b60135bdac9bc2a71478e619eaa7929f85b4729522ffe","observation_id":"cf9f0039-c899-41fd-96e7-deba8fd39018","resolution":{"observed_at":"2026-08-07T11:27:49.399243Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.393410Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.393410Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:37ce577de3cbe42690229e4b6f209b7c550948f33212999c7c3f08263e87248f","observation_id":"97a19b08-9b36-452a-b4f3-21651ea0bb56","resolution":{"observed_at":"2026-08-07T11:27:47.393410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:49.223083Z","title":null,"venue":null,"work_id":"689ad9f0-bafc-44e7-b350-84ac8ed28089","year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.399564Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:794022b9711a3de0d60613db57d884f9fcebc16e7737804037bc858b9711dd65","observation_id":"9b9643af-eeed-44d3-97cf-291528fbb9bd","resolution":{"observed_at":"2026-08-07T11:27:49.272487Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T11:27:47.405477Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.405477Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:d830bc66927f5fddcd74389d6f513a98a8090d8b3e5995f317e6ded1b7e59e04","observation_id":"28416321-807b-4036-978f-a1716094620e","resolution":{"observed_at":"2026-08-07T11:27:47.405477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.412052Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.412052Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:c0040d6f42470bc1d65d1df2d761e1d1c807fc3ed7195e6c8b612ab301c7ce8d","observation_id":"3299d20c-9e50-4068-9f5b-e6512fbb7019","resolution":{"observed_at":"2026-08-07T11:27:47.412052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.418202Z","title":"Dai, and Quoc V Le","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.418202Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:206a727f348206ff1d8458e8eb2ad9a007b70e992e80dd526c6f55322978fc3f","observation_id":"83349e79-5cd6-4017-b2b7-2d15e981583f","resolution":{"observed_at":"2026-08-07T11:27:47.418202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.424467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.424467Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:96800ab9f1b08e102357bbbf96cd3c397df704a5323beda489ded02fb860ee30","observation_id":"210a72bd-66f7-41e1-b106-a2140787b95f","resolution":{"observed_at":"2026-08-07T11:27:47.424467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:48.945836Z","title":null,"venue":null,"work_id":"fa21abea-67b8-4fe5-8b21-e6ac750c02f9","year":2022},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.430319Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:41955d758dd805d3d4eb89047ba1b9cc966dd7278f7c22c1c2908b95d83b35da","observation_id":"cfd2488b-dc86-4db2-b031-d07166648d10","resolution":{"observed_at":"2026-08-07T11:27:49.018405Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.435792Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.435792Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:f29b4bd84211e59c9f8125806ff5e94eac530596cdc4c3c6e7d576828c04c06f","observation_id":"3f819ca3-cc5c-413f-bf67-8f459f50fc71","resolution":{"observed_at":"2026-08-07T11:27:47.435792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.443024Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.443024Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:dac502fb4ad863a13171115e2243222120b5ac057dedd909831459068984e988","observation_id":"309629fa-7449-4a7c-9598-8fb71354e27a","resolution":{"observed_at":"2026-08-07T11:27:47.443024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.449114Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.449114Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:b9eb04145e11931cc0c69bf2f83cfd75141bca727fd1745a47538afbe71843c3","observation_id":"b54cedb5-02a6-4160-b10b-f12f9acbbc3f","resolution":{"observed_at":"2026-08-07T11:27:47.449114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.454913Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.454913Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:a754c833d27c59db0c6f8b4097f700abd39da066433d118c08bdde0d9a10a0de","observation_id":"c32352f6-5eb5-42a8-8ed4-8f8deedc95e8","resolution":{"observed_at":"2026-08-07T11:27:47.454913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.461431Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.461431Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:4cab8e605fa770397ae01a96d33695021e75965d26737760250d474d24f1295e","observation_id":"4e57b8c6-f9cd-4a4b-b2f0-07c74fd00440","resolution":{"observed_at":"2026-08-07T11:27:47.461431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-07T11:27:47.467267Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.467267Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:3e9cd9501eca411dc2e93953e5d63a087c5af2f9cdd7c225f97392620205d280","observation_id":"86e2506d-b829-49ed-8cf4-cd50cc697115","resolution":{"observed_at":"2026-08-07T11:27:47.467267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.475035Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.475035Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:5d9c4f80519f10b777e8b208038cb726122ed2d258187efd81b8b360c5885af7","observation_id":"411437fe-d19a-48b6-a933-82d84bff3c92","resolution":{"observed_at":"2026-08-07T11:27:47.475035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:27:47.482807Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:27:47.482807Z"},"links":{"citing_paper":"/paper/2506.02442"},"observation_digest":"sha256:d7817f25bec78b8d97fc32919c1a794466770ca4ef2795fa29be1bff3bcb5e51","observation_id":"4d16e431-eaa6-413b-a14e-88b605b2ba9d","resolution":{"observed_at":"2026-08-07T11:27:47.482807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02442","last_updated":"2025-06-04T05:56:40Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:21:26.825344Z","submitted_at":"2025-06-03T05:00:12Z","title":"Should LLM Safety Be More Than Refusing Harmful Instructions?"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":3,"verified_fuzzy":2},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2506.02442."}