{"as_of":"2026-08-08T23:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0c62b2da7a71685e9672d0691f399d997d117b3a935e1300ebfc2ec4f56cfa3d","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:28:55.461862Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.06391/citation-record","integrity":"/paper/2506.06391/integrity","json":"/paper/2506.06391/citation-record.json","paper":"/paper/2506.06391"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:52.334141Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.334141Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:e6fba3bd2b0c9a036c7a70522ec8c56bc67b2ac38985a3081da26efe9565be49","observation_id":"574a406c-f831-4253-9fb6-7e3a53640357","resolution":{"observed_at":"2026-08-07T10:28:52.334141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.06807","last_updated":"2020-09-15T00:55:00Z","snapshot_observed_at":"2026-07-06T09:55:38.633548Z","submitted_at":"2020-09-15T00:55:00Z","title":"The Radicalization Risks of GPT-3 and Advanced Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.06807","snapshot_observed_at":"2026-08-07T10:28:52.406815Z","title":"McGuffie and A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.406815Z"},"links":{"cited_paper":"/paper/2009.06807","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:136a0439c83fd705c56bf9a7901e9f6d131bbb762ba0cc5524eabe36959648df","observation_id":"60a6e142-cd78-4ee0-b820-07d5935e4212","resolution":{"observed_at":"2026-08-07T10:28:52.406815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:52.513958Z","title":"Klyman, ‘Acceptable Use Policies for Foundation Models’, Proceedings of the AAAI/ACM Conference on AI, Ethics, and So- ciety, vol","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.513958Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:1731ced5b5dc02c6f438a3a828ad21f9b9486f47435aa539dc6fbf5a747ba317","observation_id":"28f4630a-852f-4e1f-8119-cd5238a65cdf","resolution":{"observed_at":"2026-08-07T10:28:52.513958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/cbo9780511804700","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:57.648853Z","title":"Henckaerts and L","venue":null,"work_id":"4f5e7fbe-a617-4f94-b606-2e63498cd752","year":2005},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.598217Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:a8441aefd4b604b37a29ddef73daa7a5b1f85431fada19c0149c79d3154e987c","observation_id":"4358394e-7cca-4282-b6d5-daa2227aa4db","resolution":{"observed_at":"2026-08-07T10:28:57.751025Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:52.675257Z","title":"As an AI language model, I cannot","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.675257Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:70b930599f0192b8b2329e1acb7e804bdb092a3e001ea6f09ab7060d33aae356","observation_id":"7ac05577-70b5-4328-ab54-c0e57ca6e660","resolution":{"observed_at":"2026-08-07T10:28:52.675257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T10:28:52.769177Z","title":"Bai et al., ‘Constitutional AI: Harm- lessness from AI Feedback’, Dec","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.769177Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:4b96909b0ba5e3fc65091bbfb6714206a406db8dbbb42ad9b3d723d46f5f964e","observation_id":"8c19d996-7c95-40ef-8887-1083d2e49e11","resolution":{"observed_at":"2026-08-07T10:28:52.769177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16369","last_updated":"2025-07-02T07:27:32Z","snapshot_observed_at":"2026-08-07T21:23:08.873449Z","submitted_at":"2024-04-25T07:15:23Z","title":"Don't Say No: Jailbreaking LLM by Suppressing Refusal","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16369","snapshot_observed_at":"2026-08-07T10:28:52.855847Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.855847Z"},"links":{"cited_paper":"/paper/2404.16369","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:71d613d597e3f83f2432992295d31005ac79a2f8b644e7f5bd0e54c15f82ba00","observation_id":"34896cab-3e45-46f0-b59a-f53c3fcb04d0","resolution":{"observed_at":"2026-08-07T10:28:52.855847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s1816383121000096","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:57.418367Z","title":"Milaninia, ‘Biases in machine learning models and big data analytics: The inter- national criminal and humanitarian law im- plications’, Int","venue":null,"work_id":"66d746cd-91c3-4ba2-842b-9593003cf2b1","year":2020},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:52.991890Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:43c958b9cc1c483de8e37d748fdd2f1e249515e3eabb407795da64ce66b0b428","observation_id":"e2ce047c-3d2a-4395-bd65-600f955b599d","resolution":{"observed_at":"2026-08-07T10:28:57.481074Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:29:00.717002Z","title":null,"venue":null,"work_id":"1d33501e-e722-48ce-99c2-2639abd8a7bf","year":2023},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.072596Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:bf4e2e48423061a54bc9ef2cff8059a004099c861856809f451dd10eca3b826f","observation_id":"8443e5a1-ed35-40cf-8bee-b3ceebed01cd","resolution":{"observed_at":"2026-08-07T10:29:00.820672Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s00146-024-02105-9","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:57.237785Z","title":"Marcos, ‘Can large language models apply the law?’, AI and Society, pp","venue":null,"work_id":"da7919a0-9c5a-4c0c-9196-03d1dd0b5ac9","year":2024},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.208628Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:e22b0cee73edfad897286bc7922f615b28c7ddf15ffe872853a5f149667213f4","observation_id":"45affa65-05f6-4f1c-bf7a-c1414ae12f0b","resolution":{"observed_at":"2026-08-07T10:28:57.323876Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:29:00.435502Z","title":"Available: https://www.ohchr.org/en/instruments-and- mechanisms/international-human-rights-law","venue":null,"work_id":"1f40d081-aba7-49b0-9a24-8ad9d3489029","year":null},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.257276Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:ca4e7bc6d2f277d856907eaefff73d800ad2a49a61c7d922d0711ddc67826861","observation_id":"12450b47-255a-49f7-ac2c-8d758ae66a99","resolution":{"observed_at":"2026-08-07T10:29:00.597138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:29:00.147156Z","title":"Available: https://www.ohchr.org/en/resources/educato rs/human-rights-education-training/universal- declaration-human-rights-1948","venue":null,"work_id":"578e447a-5df6-4f17-a4d3-de3e4548e6fd","year":1948},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.330652Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:74f6d6d4fb6b86ba2836ec0f2efe4c49ff3b40f2a5babaacd96c8e70875cb0cf","observation_id":"3e759a0d-f949-4320-bb48-db40320f9f66","resolution":{"observed_at":"2026-08-07T10:29:00.270595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:59.840027Z","title":"Available: https://civil-protection-humanitarian- aid.ec.europa.eu/what/humanitarian- aid/international-humanitarian-law","venue":null,"work_id":"35c2dba8-287b-4c42-8c91-bcb4caa076c8","year":null},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.410472Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:e677d0cb3f3f7ffc91d45dad87b3c5621f90513ff918c4d8106508f58b6b0300","observation_id":"3165029b-0832-4650-80b5-55033597d551","resolution":{"observed_at":"2026-08-07T10:29:00.037168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s2071832200014267","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:56.974519Z","title":"MacLaren and F","venue":null,"work_id":"418d2cfd-6176-4e2d-9ee1-e1017bac54c8","year":2005},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.495867Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:88cf0e220622f22f62f1b574ef48c5bc695e67114a0ca60425f7947aa83679fd","observation_id":"cd085da7-8493-4990-bbf8-e2f95ebbc257","resolution":{"observed_at":"2026-08-07T10:28:57.065163Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2503.05021","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:56.817535Z","title":"Zhang, M","venue":null,"work_id":"d15b5276-3dc8-4831-954b-ee7b4ed991c1","year":2025},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.548232Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:90b69bb74360198aad2b7a7ec486c481b251fd65504673f26a530cae24cd850c","observation_id":"5d3d0bd1-5305-4e1f-a526-c2f80c6b4fe7","resolution":{"observed_at":"2026-08-07T10:28:56.915104Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.08145","last_updated":"2025-01-14T14:23:18Z","snapshot_observed_at":"2026-08-05T16:43:12.384747Z","submitted_at":"2025-01-14T14:23:18Z","title":"Refusal Behavior in Large Language Models: A Nonlinear Perspective","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.08145","snapshot_observed_at":"2026-08-07T10:28:53.629021Z","title":"Hildebrandt, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.629021Z"},"links":{"cited_paper":"/paper/2501.08145","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:c4ff69a47afe1c654bb6bee172df228c53c57adbf7a841050c7254cf6773f018","observation_id":"65ccd62e-d953-4566-8f4a-68a419aa1c14","resolution":{"observed_at":"2026-08-07T10:28:53.629021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11969","last_updated":"2025-04-17T18:36:08Z","snapshot_observed_at":"2026-07-06T18:47:21.527912Z","submitted_at":"2024-07-16T17:59:55Z","title":"Does Refusal Training in LLMs Generalize to the Past Tense?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11969","snapshot_observed_at":"2026-08-07T10:28:53.683286Z","title":"Andriushchenko and N","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.683286Z"},"links":{"cited_paper":"/paper/2407.11969","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:0afc9692e01c560d05ab25dde7efb14206fee5512c0c398240511ca5291add97","observation_id":"f9e61acd-30ff-4dbb-9931-d312de3603c9","resolution":{"observed_at":"2026-08-07T10:28:53.683286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:59.456097Z","title":null,"venue":null,"work_id":"45144250-2e3d-4f41-98b0-785f1d92f116","year":2024},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.775394Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:f6b1b9f8efb4bbd2935ea91befc88d579a3fe9813722f9b7dab214e1afc1185e","observation_id":"4ca58ba4-11fb-4382-a51a-9873aae6d3e4","resolution":{"observed_at":"2026-08-07T10:28:59.670807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s0922156523000390","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:56.537323Z","title":"Pomson, ‘Methodology of identifying cus- tomary international law applicable to cyber activities’, LeidenJournalofInternationalLaw, vol","venue":null,"work_id":"604c49a5-e046-403c-9a1b-8b395b08972d","year":2023},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.880018Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:9344cd52a763a05188033359b4a0cb9b155159f047ebb41fb9384396b095f60d","observation_id":"ddeb866e-b736-45a1-ba20-8621612a8231","resolution":{"observed_at":"2026-08-07T10:28:56.616471Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:59.117424Z","title":"Yudkowsky, ‘The AI Alignment Prob- lem: Why It’s Hard, and Where to Start’","venue":null,"work_id":"5cd96c92-dafe-42ab-a0a1-5f0a7089e860","year":2016},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:53.958238Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:48b9564cfd161531c3020ecd7c8d2a18998bb2cd3c0fd2c6b088ce382f58fbfc","observation_id":"40d66404-5b12-4fde-ba51-478a18715cb4","resolution":{"observed_at":"2026-08-07T10:28:59.339063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:54.089537Z","title":"Gabriel, ‘Artificial Intelligence, Values, and Alignment’, Minds and Machines, vol","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.089537Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:ee8b244548b9f344f19abbf7b7983053f6ccc226b86581209b0eda62018cd69f","observation_id":"315cca8b-bb6b-4a48-8416-01e8c44dad0e","resolution":{"observed_at":"2026-08-07T10:28:54.089537Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:58.832404Z","title":null,"venue":null,"work_id":"1019697a-594d-44e5-8193-bb8f3b50da46","year":2023},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.214140Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:f881d75c44ce1e04839e78ac548dc476c84ff226f52626efbc6198ebcbb84691","observation_id":"25992e24-38b4-4f99-bd6d-29bf0b781559","resolution":{"observed_at":"2026-08-07T10:28:58.947214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:58.591861Z","title":null,"venue":null,"work_id":"42e4f04c-b385-418d-9212-7920c82b1867","year":2024},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.289250Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:fa56a58baaa7a0235991ce99fd9c62c80705bf680efb92eee2f6fb2492af95c0","observation_id":"20671a0a-4bb0-4bc0-bdfb-d614d4463660","resolution":{"observed_at":"2026-08-07T10:28:58.661986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05282","last_updated":"2025-04-09T11:34:12Z","snapshot_observed_at":"2026-08-03T19:50:55.239079Z","submitted_at":"2024-11-05T15:47:23Z","title":"International Scientific Report on the Safety of Advanced AI (Interim Report)","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05282","snapshot_observed_at":"2026-08-07T10:28:54.373523Z","title":"Bengio et al., ‘International Scientific Re- port on the Safety of Advanced AI (Interim Re- port)’, Nov","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.373523Z"},"links":{"cited_paper":"/paper/2412.05282","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:17a5ede6cda5871aa695922ec2aaeaf648e2e9b081c59dcd151fe30cf86c9f22","observation_id":"aeea0786-0e18-48f6-9888-f708798daa3b","resolution":{"observed_at":"2026-08-07T10:28:54.373523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.57599/gisoj.2024.4.1.66","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:56.300706Z","title":"Strzępek, ‘Human Rights as a Factor in the AI Alignment’, GIS Odyssey Journal, vol","venue":null,"work_id":"4b86f15d-6aac-4ff0-bcca-63b37af2b972","year":2024},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.475083Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:28db5629c7d89dfdb2a8e10508841f30469e66c098ea60d7611804ae19837dc9","observation_id":"e4130bbd-beee-4440-986e-657d2eec1104","resolution":{"observed_at":"2026-08-07T10:28:56.407578Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.57599/gisoj.2023.3.2.25","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:56.129290Z","title":"Szpor, ‘European Legal Framework for the Use of Artificial Intelligence in Pub- licly Accessible Space’, GIS Odyssey Journal, vol","venue":null,"work_id":"f2add4e6-070a-44bb-8014-10016b85f46c","year":2023},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.569206Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:33eacd7f5143313abb8b6a2782c686fc8df629b29ab6a92ba1f41a3661a792b4","observation_id":"4f2251a5-a415-4c12-b106-67f98b8ce38b","resolution":{"observed_at":"2026-08-07T10:28:56.199379Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:54.645387Z","title":"Novelli, F","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.645387Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:52021f51b7466c55fbed785b3fd4db7fff9c862820b415611a8edcb7690a1e97","observation_id":"a0548506-e31e-4e21-91d2-9ec7121100b2","resolution":{"observed_at":"2026-08-07T10:28:54.645387Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2307.04657","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:55.948488Z","title":"Ji et al., ‘BeaverTails: Towards Im- proved Safety Alignment of LLM via a Human-Preference Dataset’, Nov","venue":null,"work_id":"d8ac3b2b-fd19-41f9-8873-c768d801f74b","year":2023},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.719928Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:37b3d8590a6d77fe888c1f86cc70ab0f49179753d3c0e0e0ff489367b3a64347","observation_id":"eef5aa8c-12ea-43a2-b88e-362704391942","resolution":{"observed_at":"2026-08-07T10:28:56.024830Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17389","last_updated":"2023-10-26T13:35:41Z","snapshot_observed_at":"2026-07-06T16:38:56.540232Z","submitted_at":"2023-10-26T13:35:41Z","title":"ToxicChat: Unveiling Hidden Challenges of Toxicity Detection in Real-World User-AI Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17389","snapshot_observed_at":"2026-08-07T10:28:54.802416Z","title":"Lin et al., ‘ToxicChat: Unveiling Hid- den Challenges of Toxicity Detection in Real-World User-AI Conversation’, Oct","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.802416Z"},"links":{"cited_paper":"/paper/2310.17389","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:48e3342fbb74225da5d9b68a51723713e66a9e7bdfaebdda17d90d3b6528ea7c","observation_id":"c0f879a3-92f5-496f-abec-9b8f05638b4d","resolution":{"observed_at":"2026-08-07T10:28:54.802416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:58.379203Z","title":"https://platform.openai.com","venue":null,"work_id":"4542c960-be93-4fe1-b47f-235025aa5726","year":null},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.893392Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:a64c417cb6b28799aec49126f9387d55d4ed163dfc78b8bcdf7382dca6c2835a","observation_id":"5e333f84-534b-47cf-826d-86effaff999f","resolution":{"observed_at":"2026-08-07T10:28:58.482180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20947","last_updated":"2025-06-15T21:44:25Z","snapshot_observed_at":"2026-07-06T18:23:23.565502Z","submitted_at":"2024-05-31T15:44:33Z","title":"OR-Bench: An Over-Refusal Benchmark for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20947","snapshot_observed_at":"2026-08-07T10:28:54.986950Z","title":"Cui, W.-L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:54.986950Z"},"links":{"cited_paper":"/paper/2405.20947","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:5d9ca12b53063086dc33cd6fcc1617db259f0ec478d55849347b3dc233745a38","observation_id":"14de37fd-3c28-4821-adbe-efc2d4d0a818","resolution":{"observed_at":"2026-08-07T10:28:54.986950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T10:28:55.100445Z","title":"Inan et al., ‘Llama Guard: LLM- based Input-Output Safeguard for Human-AI Conversations’, 2023, doi: 10.48550/arXiv.2312.06674","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:55.100445Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:cfacdb182c30d7a9d8c89d17726bc42b98fcdca4d41998ea70d2e972597c5f29","observation_id":"ea34ee52-42ec-4c1e-ae5d-96a5e1f37298","resolution":{"observed_at":"2026-08-07T10:28:55.100445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13458","last_updated":"2025-05-27T22:35:37Z","snapshot_observed_at":"2026-08-08T01:24:47.078251Z","submitted_at":"2025-02-19T06:09:58Z","title":"ThinkGuard: Deliberative Slow Thinking Leads to Cautious Guardrails","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13458","snapshot_observed_at":"2026-08-07T10:28:55.208535Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:55.208535Z"},"links":{"cited_paper":"/paper/2502.13458","citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:7b8210f21fe54f6d425993e5a14954de97936c102a4b10361a167c4fad55319f","observation_id":"19f8fb8a-0a31-4957-a2da-2040eaa170a2","resolution":{"observed_at":"2026-08-07T10:28:55.208535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2501.15693","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:55.656644Z","title":"Stanovsky, R","venue":null,"work_id":"141f7c57-b1b2-49a2-bab9-2b4730e95286","year":2025},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:55.290535Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:847086fec214bf321db8bc3b6a6f6fd35820cc17d141beb57130093e2069a25a","observation_id":"af9d2d6b-db8e-4234-86da-380e59faee2c","resolution":{"observed_at":"2026-08-07T10:28:55.714860Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:55.374050Z","title":"Scheutz, R","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:55.374050Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:23082e2ad6da180731889fa7f669e4c24ded8c696569ef3c06ed81057389067d","observation_id":"c6970e34-3663-4ae1-9c1e-4db664fc4553","resolution":{"observed_at":"2026-08-07T10:28:55.374050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:28:58.141644Z","title":"Claude 3.7 system card","venue":null,"work_id":"503562dd-c65d-4070-a8ee-4c744d59270b","year":null},"citing_paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:28:55.461862Z"},"links":{"citing_paper":"/paper/2506.06391"},"observation_digest":"sha256:faa6ee6ce6ffdacc3e163825fe04cce913c97eed63538fca564dbfb50cc6454f","observation_id":"9ed424fb-6b34-4866-ac7e-41c3de476ada","resolution":{"observed_at":"2026-08-07T10:28:58.271519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06391","last_updated":"2025-06-05T16:53:29Z","latest_version":1,"primary_category":"cs.CY","snapshot_observed_at":"2026-08-08T01:20:47.850082Z","submitted_at":"2025-06-05T16:53:29Z","title":"From Rogue to Safe AI: The Role of Explicit Refusals in Aligning LLMs with International Humanitarian Law"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":10,"verified_fuzzy":6},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2506.06391."}