{"as_of":"2026-08-21T23:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:26ca4e0d24b7735106c7c7b2af72263658bf27392e68f58007c2674039a6c9bf","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T14:12:28.473434Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.13304/citation-record","integrity":"/paper/2608.13304/integrity","json":"/paper/2608.13304/citation-record.json","paper":"/paper/2608.13304"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.00598","last_updated":"2025-06-11T03:14:28Z","snapshot_observed_at":"2026-08-19T19:23:21.576241Z","submitted_at":"2024-09-01T03:25:59Z","title":"Automatic Pseudo-Harmful Prompt Generation for Evaluating False Refusals in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00598","snapshot_observed_at":"2026-08-14T14:12:28.323410Z","title":"arXiv preprint arXiv:2409.00598 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.323410Z"},"links":{"cited_paper":"/paper/2409.00598","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:9bb547912ab38a01fb9ca0b4041cde60523e7015fa0e473ca7b80694b111b231","observation_id":"9b8a67bf-7cd3-45e2-bfe7-67bd7f040adc","resolution":{"observed_at":"2026-08-14T14:12:28.323410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.329570Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.329570Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:1a440b31be4ff5b1227cae7f0a7412bc69e8609e98dbb59559e657c50fd10dd2","observation_id":"97354491-ad63-49f5-b84f-1015b6355b72","resolution":{"observed_at":"2026-08-14T14:12:28.329570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.02893","last_updated":"2020-03-27T19:07:58Z","snapshot_observed_at":"2026-08-16T03:32:37.688772Z","submitted_at":"2019-07-05T15:26:26Z","title":"Invariant Risk Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.02893","snapshot_observed_at":"2026-08-14T14:12:28.333237Z","title":"arXiv preprint arXiv:1907.02893 , year=","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.333237Z"},"links":{"cited_paper":"/paper/1907.02893","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:f7ad2d6b0a25f549b73500bb324e165bfba2c5855d7ee1a380bf65808fa62cb5","observation_id":"2de20a36-b891-457d-b87b-c383671b4e83","resolution":{"observed_at":"2026-08-14T14:12:28.333237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-14T14:12:28.336772Z","title":"arXiv preprint arXiv:2212.08073 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.336772Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:fe940fc80ac88083a19e55f4c19f49f0be56de99dc65f700d25c102384771b1c","observation_id":"cd2e7f94-33b0-4e35-9bba-b0f516457dde","resolution":{"observed_at":"2026-08-14T14:12:28.336772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-14T14:12:28.340232Z","title":"arXiv preprint arXiv:2204.05862 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.340232Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:775d1731219dee641de1365469bea3783d8b2b6b501ce97de68cd001946ca4d4","observation_id":"da153312-d524-4ee3-aabe-de876a85c9bc","resolution":{"observed_at":"2026-08-14T14:12:28.340232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.971941Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"93e738f0-c436-4e9f-8a85-ce5390a4dd6e","year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.344793Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:c025a82a99eb71422eb108499da913090f743ef75f75bb84ccba74cd9da78a21","observation_id":"3169123b-3119-4a71-b625-c39d90b2a089","resolution":{"observed_at":"2026-08-14T14:12:28.975192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.348535Z","title":"2025 IEEE Conference on Secure and Trustworthy Machine Learning (SaTML) , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.348535Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:0787a7d33a648912b31629c174605a78e414dd8184b24c298d986f50bcf1301c","observation_id":"06120b13-6b41-4d7c-a3ce-313404f98b82","resolution":{"observed_at":"2026-08-14T14:12:28.348535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-14T14:12:28.352375Z","title":"URL https://arxiv","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.352375Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:ac3afc4f1e614e00dbb8b78962dd3e09a4aa2a7e64a3742002f0d44b2e17d54e","observation_id":"fe7c96a7-e548-4d36-85dc-35f1540b9683","resolution":{"observed_at":"2026-08-14T14:12:28.352375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20947","last_updated":"2025-06-15T21:44:25Z","snapshot_observed_at":"2026-08-19T07:28:13.224791Z","submitted_at":"2024-05-31T15:44:33Z","title":"OR-Bench: An Over-Refusal Benchmark for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20947","snapshot_observed_at":"2026-08-14T14:12:28.356256Z","title":"arXiv preprint arXiv:2405.20947 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.356256Z"},"links":{"cited_paper":"/paper/2405.20947","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:3ca0dc2797b54e58bf387af36e08070e7ae3b666623118ffa8624f0485e61651","observation_id":"1732f4de-e3f7-48e6-a487-20841a7b14d7","resolution":{"observed_at":"2026-08-14T14:12:28.356256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.956784Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"d6e0e064-b0f4-4dcf-90fe-3568f0ce9399","year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.359755Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:fbc6bfccb78726202522af08a419c3a0cb0e4354c731e7f7896a90ce396d6b77","observation_id":"59f97c4c-f1c5-4c09-b886-96b2e9f8adc1","resolution":{"observed_at":"2026-08-14T14:12:28.961433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-08-21T13:43:54.063053Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-14T14:12:28.363257Z","title":"arXiv preprint arXiv:2209.07858 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.363257Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:0d71a44cc86a7d511b3e20acbdf95379d991936959845585c2d383b0f2f20ffa","observation_id":"c14cb657-1c79-4886-91ba-abf8b8dd313f","resolution":{"observed_at":"2026-08-14T14:12:28.363257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-14T14:12:28.366342Z","title":"arXiv preprint arXiv:2407.21783 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.366342Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:cfc8fefdf257a6b4d5dd6652c4cb5075e34685e678836968bec499f0618abfc5","observation_id":"f2c336fd-7446-4029-9116-791251096cb6","resolution":{"observed_at":"2026-08-14T14:12:28.366342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.369488Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.369488Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:993ae0471aba8fddbdb524ada2fe8549e9d416460eaa4f89e483f63fa4219b5f","observation_id":"78679640-7e1d-4a8b-91c8-891e967954f0","resolution":{"observed_at":"2026-08-14T14:12:28.369488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-14T14:12:28.372250Z","title":"arXiv preprint arXiv:2009.03300 , year=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.372250Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:5e4683c7d9cedc3db991bac2b553d159e07265959aa8ec50ce4896d6c1468f58","observation_id":"f63d237d-694f-40b3-91a0-71eecb706527","resolution":{"observed_at":"2026-08-14T14:12:28.372250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-08-14T15:42:19.849118Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-14T14:12:28.375474Z","title":"arXiv preprint arXiv:2312.06674 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.375474Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:56cd9c85f7f8f155d5d402b1204963f799e3027d8aa927580b2d3aba5a93f58f","observation_id":"807c0567-1311-43d2-8362-47f692a53ac4","resolution":{"observed_at":"2026-08-14T14:12:28.375474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.378989Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.378989Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:c78e57cde3750b5db45837d8a400ed7a3c2e39c4ebf6310f110dfabb18409090","observation_id":"4816d49b-e5be-4569-854a-60741ee7d0b2","resolution":{"observed_at":"2026-08-14T14:12:28.378989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.936785Z","title":"Proceedings of the Nineteenth ACM International Conference on Web Search and Data Mining , pages=","venue":null,"work_id":"c38478f4-7947-45c4-b7e4-d2ed0e9db500","year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.381905Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:68ff77c18991a71785f5297116097f6b4ec5cd7a48a3ec8b39526f2a67efc79a","observation_id":"86b0100d-926b-4919-b829-b1ee10dd32d9","resolution":{"observed_at":"2026-08-14T14:12:28.941122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.384928Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.384928Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:16062c060f7c1f4006ef72ba16a520a5df9a6f37fb19b1d3d24d9f7750e92f15","observation_id":"7903d8cc-00b4-43cb-93ae-3ccbd56bdbeb","resolution":{"observed_at":"2026-08-14T14:12:28.384928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-14T14:12:28.387665Z","title":"arXiv preprint arXiv:2402.04249 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.387665Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:5a002e08150e6bb9ba59aa203654e3b799589549cda9d3633b605793bcc0d299","observation_id":"cf9198c1-0bad-41b0-a41b-04f7d82d1266","resolution":{"observed_at":"2026-08-14T14:12:28.387665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.391343Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.391343Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:05f1406c0b6850597cfed911632b266f501d3f92da8a481d5acfdbc3417f3d62","observation_id":"1eaef203-e547-4026-ab80-5a7f1ed1d536","resolution":{"observed_at":"2026-08-14T14:12:28.391343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.394560Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.394560Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:6086c773db73ab62b7b945ff1b3fa3726dd5d70a2d4cca26a06293a30ae6e192","observation_id":"7e624d8e-17e8-4c9f-b802-eec9fe520552","resolution":{"observed_at":"2026-08-14T14:12:28.394560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.397390Z","title":"Proceedings of the 2022 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.397390Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:6655eb5cb59739df05e5bea5dd6fdc7da1c5a4a487d68c659370d6aa5f9b94b8","observation_id":"a8e84fa7-8f57-48ae-8948-a015970e3c81","resolution":{"observed_at":"2026-08-14T14:12:28.397390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.907037Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"5afb6f53-7045-4067-a96b-97beb5dd0efd","year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.400871Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:8b5a8204f3a0fe713b0acc0f4910cda13ce42f69dc53aef3f171cebf8ea531b7","observation_id":"a354e311-12e8-4b7c-8170-1feebaa57509","resolution":{"observed_at":"2026-08-14T14:12:28.910625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.403982Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.403982Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:013df97ff5860cd2c9879e40e1a4ce4f9e16097dc1a3a8b861beb6a171bc0d97","observation_id":"f89062d1-fdab-4597-b0e5-cb01905b2242","resolution":{"observed_at":"2026-08-14T14:12:28.403982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.406905Z","title":"Proceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.406905Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:87d5ff2261b19f9c14854f0d0f9615b79b6dd69e34b7d411048fc5948fa46d6d","observation_id":"fdee1468-d2eb-457e-aa41-1b9f02e0c4fb","resolution":{"observed_at":"2026-08-14T14:12:28.406905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08731","last_updated":"2020-04-02T05:40:29Z","snapshot_observed_at":"2026-08-17T18:58:45.514336Z","submitted_at":"2019-11-20T06:43:41Z","title":"Distributionally Robust Neural Networks for Group Shifts: On the Importance of Regularization for Worst-Case Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.08731","snapshot_observed_at":"2026-08-14T14:12:28.410434Z","title":"arXiv preprint arXiv:1911.08731 , year=","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.410434Z"},"links":{"cited_paper":"/paper/1911.08731","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:324794d4b802a00d0c3a5630a744785afe2e1333a752764d8b59e5a1a88b624b","observation_id":"aec5d0a9-107a-4e68-8603-97cc997c3182","resolution":{"observed_at":"2026-08-14T14:12:28.410434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.01088","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.705446Z","title":"arXiv preprint arXiv:2510.01088 , year=","venue":null,"work_id":"8e1ed241-9ad0-4f19-9a77-3b52e686b2fe","year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.413881Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:182d526f4606ca3cd2ee82140e648af1a7e0eb30e55c2eea72c4b8474f311f58","observation_id":"54785673-4401-4543-96f5-6fbcff5a866a","resolution":{"observed_at":"2026-08-14T14:12:28.709868Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.416849Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.416849Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:f476b271d114b540720ada85ebd919ef34aa3920a9c337d0847c824c3c8b8b6d","observation_id":"8041ce5d-4190-49a0-88ed-613ccdc69b84","resolution":{"observed_at":"2026-08-14T14:12:28.416849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.419700Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.419700Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:a6281c2b8d441983f8a4f738205e95008c042a169bb6d1d9c27ea54555000ebb","observation_id":"2f0079cb-03bb-41fb-9f6a-958af737b8dc","resolution":{"observed_at":"2026-08-14T14:12:28.419700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.422498Z","title":"2023 , publisher=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.422498Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:143ba2a6395167b451efd548cd66632e8a0d9b68c40467f64872358d681b13f0","observation_id":"c74e5fba-8f42-44f0-a855-a35f0cf62ba1","resolution":{"observed_at":"2026-08-14T14:12:28.422498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.13208","last_updated":"2024-04-19T22:55:23Z","snapshot_observed_at":"2026-08-11T23:45:02.178667Z","submitted_at":"2024-04-19T22:55:23Z","title":"The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.13208","snapshot_observed_at":"2026-08-14T14:12:28.425550Z","title":"arXiv preprint arXiv:2404.13208 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.425550Z"},"links":{"cited_paper":"/paper/2404.13208","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:e7306cbc7f53d0e9b88d90252413fce2f64664788d282163db80f5f881d3c146","observation_id":"5e55f52f-0bf2-4e43-8455-e9abd80dd40b","resolution":{"observed_at":"2026-08-14T14:12:28.425550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13387","last_updated":"2023-09-04T01:47:30Z","snapshot_observed_at":"2026-08-16T15:05:47.548037Z","submitted_at":"2023-08-25T14:02:12Z","title":"Do-Not-Answer: A Dataset for Evaluating Safeguards in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.13387","snapshot_observed_at":"2026-08-14T14:12:28.428776Z","title":"arXiv preprint arXiv:2308.13387 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.428776Z"},"links":{"cited_paper":"/paper/2308.13387","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:e284caae9c49546eca60e59bd56fbc8c3d46368a4eecb2674afac5b96aeaba22","observation_id":"4e715314-ab13-4c74-a64e-f00630d317c7","resolution":{"observed_at":"2026-08-14T14:12:28.428776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.432367Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.432367Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:bee822823f191fda8cd2f89d14fe70436b27db6bcd89db689a104a5e990c98c3","observation_id":"55d282ef-cc6e-4111-af68-c2c3f080eeab","resolution":{"observed_at":"2026-08-14T14:12:28.432367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.868600Z","title":"IEEE Transactions on Image Processing , volume=","venue":null,"work_id":"dfd73608-d976-4019-83c8-d2e5ca4e7185","year":2016},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.435932Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:74e972513588f2882213d7c118c97511cd107ba2315fd0ec1cb74ddb8618f227","observation_id":"0ff73026-1da2-443e-abe8-1ac1e16d4ce6","resolution":{"observed_at":"2026-08-14T14:12:28.871862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.438701Z","title":"Nature Machine Intelligence , volume=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.438701Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:8caf6cec10a8438519b07abca1f3eca8ba5b9a31b950e70db3feee5138acca75","observation_id":"b9c76bd1-ed02-45c1-9c41-03d357e73ae5","resolution":{"observed_at":"2026-08-14T14:12:28.438701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.852997Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"b945b94b-ac7d-4dc9-80db-8e0ecd150097","year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.442274Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:e651583f4e461beb906a8108f1a1cfb7a2cf50baede1044db2a11bd646ea1e7b","observation_id":"ca387344-c9ff-4634-a74c-0ea94bd3cc1e","resolution":{"observed_at":"2026-08-14T14:12:28.857324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08054","last_updated":"2025-07-15T10:03:15Z","snapshot_observed_at":"2026-08-19T20:05:11.167007Z","submitted_at":"2025-05-12T20:45:25Z","title":"FalseReject: A Resource for Improving Contextual Safety and Mitigating Over-Refusals in LLMs via Structured Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.08054","snapshot_observed_at":"2026-08-14T14:12:28.445065Z","title":"arXiv preprint arXiv:2505.08054 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.445065Z"},"links":{"cited_paper":"/paper/2505.08054","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:a621db9729ba732361844af3eaf3a2ab1b447f76f530ec8a255d0467462dc6b2","observation_id":"08d54f6e-969b-477e-84b4-09a858bdb077","resolution":{"observed_at":"2026-08-14T14:12:28.445065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.448051Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.448051Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:e3fd10d7e51696a54165fc4fdc8cb5d36189d67581994c6832ade4a3fc0c21d8","observation_id":"7814da34-bd66-4db7-9a68-759d44aff9ee","resolution":{"observed_at":"2026-08-14T14:12:28.448051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.838918Z","title":"Proceedings of the 31st International Conference on Computational Linguistics , pages=","venue":null,"work_id":"d8972943-e0d5-4354-acb6-da10f5655624","year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.451382Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:6b0ab5b20d431ab18afca3c5bbfa3d25e5a0c23e0bd90909c4618dbf20445598","observation_id":"fda27cdc-6550-41c8-a596-644a57cfcc91","resolution":{"observed_at":"2026-08-14T14:12:28.842329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.454021Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.454021Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:a2dc6abf3a3e33001089b855604c9688a3bbc53a404112171e325eff368069eb","observation_id":"8885a504-5351-4932-a052-135c6ec83a4f","resolution":{"observed_at":"2026-08-14T14:12:28.454021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.456910Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.456910Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:0b5d59b0ac720970cc938d7b510aa25fef5592b6b65144444dc5a682fa9ac33d","observation_id":"0a2d8aba-da77-4b2c-987c-dda0a8fa4a76","resolution":{"observed_at":"2026-08-14T14:12:28.456910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-14T14:12:28.459777Z","title":"arXiv preprint arXiv:2307.15043 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.459777Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:c1bad7f8da05db9578e873f7d6bfc5cc82bc113a3d3fcf4b8a5cb9572e68c8a4","observation_id":"e112e15a-69d8-4d94-9977-e387602d34bf","resolution":{"observed_at":"2026-08-14T14:12:28.459777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.1493","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.492418Z","title":"Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking","venue":null,"work_id":"810ece6f-7562-4cce-b921-6ce11f70c285","year":2025},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.463637Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:77e382947d38aedec33cc14c2db97985d4cc9dfc99a265ccba987f83c90e4ea9","observation_id":"e3b77a98-795d-45d8-842d-db682d6a57b3","resolution":{"observed_at":"2026-08-14T14:12:28.497283Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.820866Z","title":"2023 , howpublished =","venue":null,"work_id":"66c25fdb-820b-4441-8a7b-23b5d9322d35","year":2023},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.467351Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:820c6dc0a85926aece135e0e73cfbb4df71e5b5acb0e2dfcaaef3fa1a7cbf9d2","observation_id":"41268f89-688f-4aaf-af12-31433f44b349","resolution":{"observed_at":"2026-08-14T14:12:28.823879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.470119Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.470119Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:eb738077d308670864d25863d43b733ef1e327629b1738f6e08faefebd2f796e","observation_id":"805dd500-05aa-4ece-9b46-7b98a4e924ed","resolution":{"observed_at":"2026-08-14T14:12:28.470119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T14:12:28.807275Z","title":"2024 , url =","venue":null,"work_id":"0603ce7d-fe9f-4c46-ba23-f94486a8aa45","year":2024},"citing_paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-14T14:12:28.473434Z"},"links":{"citing_paper":"/paper/2608.13304"},"observation_digest":"sha256:bcb967dd1eda9e8e3840877698c5e59defc9d756744ffd3aff4219b1a7b056e3","observation_id":"ca9d742f-4247-49ae-923d-d9065fc2d156","resolution":{"observed_at":"2026-08-14T14:12:28.810208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.13304","last_updated":"2026-08-13T14:33:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-21T12:05:49.901751Z","submitted_at":"2026-08-13T14:33:15Z","title":"Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":35,"verified_exact":2,"verified_fuzzy":9},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2608.13304."}