{"as_of":"2026-08-07T05:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:204a66cb22d8a9d46560d03033b24e8b35320276685a126473114bf79cb3bd05","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:18:40.850181Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06282/citation-record","integrity":"/paper/2507.06282/integrity","json":"/paper/2507.06282/citation-record.json","paper":"/paper/2507.06282"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:43.708757Z","title":"GuardBench: A Large-Scale Benchmark for Guardrail Models","venue":null,"work_id":"7eb4acce-9d3f-4086-b7a6-7dcbf00ee49e","year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:38.633982Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:b341afb66e2621684b3fe249df598278a6b6aab50aeb4084f3da1f5295b306c9","observation_id":"2c91e3e0-d55e-4ba2-af12-aebd325fadf1","resolution":{"observed_at":"2026-08-06T19:18:43.818607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:43.381438Z","title":"Constitutional Classifiers: Defending against Universal Jailbreaks across Thousands of Hours of Red Teaming,","venue":null,"work_id":"87918439-c1be-4028-9114-4337881e1d79","year":2025},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:38.761731Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:adf6d7200fb931728d2e93fbde1fb00caea0fd7d4ec6daa6c5cc3fee5499b421","observation_id":"a52d6d52-2bd2-43c6-b438-7005ac68bff6","resolution":{"observed_at":"2026-08-06T19:18:43.563105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:43.117772Z","title":"NeurIPS 2024 Datasets and Benchmarks Track, 2024","venue":null,"work_id":"2ff2ccfb-3cb9-49a7-82e9-ac903dc8b185","year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:38.810817Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:78187927fa139f86bff0ad0099f4c6484467fbfba24a818fc9c1840170f05a8f","observation_id":"f8c82631-8dd1-4ee7-8b64-f927f3aa1a4a","resolution":{"observed_at":"2026-08-06T19:18:43.272682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03825","last_updated":"2024-05-15T12:06:31Z","snapshot_observed_at":"2026-07-06T16:03:34.432602Z","submitted_at":"2023-08-07T16:55:20Z","title":"\"Do Anything Now\": Characterizing and Evaluating In-The-Wild Jailbreak Prompts on Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03825","snapshot_observed_at":"2026-08-06T19:18:38.885620Z","title":"Do Anything Now","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:38.885620Z"},"links":{"cited_paper":"/paper/2308.03825","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:f80e2d7e75f775066a20fc2d624ca99ee026c58aba754b38f61554dd81dc296a","observation_id":"039fb256-65d4-4e2c-9e55-e0bbc9b68aee","resolution":{"observed_at":"2026-08-06T19:18:38.885620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.14598","last_updated":"2025-03-01T21:45:36Z","snapshot_observed_at":"2026-07-06T18:34:29.513732Z","submitted_at":"2024-06-20T17:56:07Z","title":"SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.14598","snapshot_observed_at":"2026-08-06T19:18:39.027078Z","title":"SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal Behaviors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.027078Z"},"links":{"cited_paper":"/paper/2406.14598","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:585fdbdd3a47c65812bcecff5c7e7f2110ee2a245ac5458c6028404b620606ce","observation_id":"52615106-1ebe-4879-9046-de714e9e8211","resolution":{"observed_at":"2026-08-06T19:18:39.027078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.986399Z","title":"AdvBench: Universal and Transferable Ad- versarial Attacks on Aligned Language Models,","venue":null,"work_id":"346fd1f8-4aa3-4d4b-9326-fc7861d4c2ab","year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.230798Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:288d1d53b1b79e3ee1ccb010069fb03294b0cd64961ca1dbab1b532354289da8","observation_id":"df1cfef7-9e07-4e97-95c8-dabb2346ac2e","resolution":{"observed_at":"2026-08-06T19:18:43.058381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.812500Z","title":"CatQA: A Dataset for Categorizing Questions as Safe or Unsafe,","venue":null,"work_id":"0c161e3b-693e-4d10-be7c-860bb03477ba","year":2025},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.311873Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:14d2590b8a03f207f39febdb4581bc8ad9d2b0df973c34a8678fd40cdd3ea2ce","observation_id":"23662cfe-a460-48e7-96b9-ee0dac2f98c2","resolution":{"observed_at":"2026-08-06T19:18:42.891885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.617027Z","title":"Do Not Answer: Testing AI Refusal to Unsafe Questions,","venue":null,"work_id":"4ec257bb-3eb0-4a59-8868-8f74aa1b5025","year":2025},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.365817Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:289dbcb5a14cc38fdfcf079ce19aea17645159f0107d32b846065c63b31b8a62","observation_id":"f1c918c9-da12-4d60-8c4e-c6abb5eddbd7","resolution":{"observed_at":"2026-08-06T19:18:42.701691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.341572Z","title":"HH-RLHF: Helpful and Harmless Reinforcement Learning from Hu- man Feedback,","venue":null,"work_id":"6966bb76-89db-4170-bbcd-420b2ad28186","year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.472725Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:edc638b1e45c46328d37995f26100245863d7664a8c9089ca46a22e909189364","observation_id":"c0105b1f-cfac-43dd-8207-35d7d779c5c9","resolution":{"observed_at":"2026-08-06T19:18:42.506895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-06T19:18:39.588048Z","title":"BELLS: A Framework Towards Future Proof Benchmarks for the Evaluation of LLM Safeguards","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.588048Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:4c8ea7f5ff8f962253b1c16dba3ab6cf24f99b36b682972059f5393c4ff5c580","observation_id":"8543b09b-adba-4383-be52-c9d1d4dff676","resolution":{"observed_at":"2026-08-06T19:18:39.588048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10260","last_updated":"2024-08-27T03:32:47Z","snapshot_observed_at":"2026-08-04T21:32:35.483431Z","submitted_at":"2024-02-15T18:58:09Z","title":"A StrongREJECT for Empty Jailbreaks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10260","snapshot_observed_at":"2026-08-06T19:18:39.703539Z","title":"NeurIPS 2024 Datasets and Benchmarks Track, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.703539Z"},"links":{"cited_paper":"/paper/2402.10260","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:d332055fd973079b548d796f65359835d8851c448cda7ce97d1a9d97d6f64a7c","observation_id":"9a3352f7-c722-4e0a-92c8-3a166a2de097","resolution":{"observed_at":"2026-08-06T19:18:39.703539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:42.174225Z","title":"The Twelfth International Conference on Learning Representations, 2024","venue":null,"work_id":"76035d94-ffe2-4d92-b517-c10076cb54c7","year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.798982Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:c1dbc221843114cfc6cd018cf6e53f59bfa166a97db008d470c64bf3ae4982d6","observation_id":"f6b9e1a3-e909-4b4a-9aab-9f0e404c9aac","resolution":{"observed_at":"2026-08-06T19:18:42.239110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:41.932580Z","title":null,"venue":null,"work_id":"2f2db35a-91e1-42ed-b28d-1c8112ec0530","year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:39.887601Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:dc7c1e727c7e608797d24550add11f316384556a6cc064dea4d977a6740b7ce6","observation_id":"82e96a74-af9e-44c2-99d9-b2a6927de0eb","resolution":{"observed_at":"2026-08-06T19:18:42.037851Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:41.625883Z","title":null,"venue":null,"work_id":"0fa2cb77-30a1-4f78-9035-0f44f5408b13","year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.022590Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:f3acf3f7556b3e1c6cc9195c0c586b61c18720269125f1ad71e420f13d8a7ef0","observation_id":"219f32df-033c-482f-bf49-dc911055af8f","resolution":{"observed_at":"2026-08-06T19:18:41.743137Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-04T19:12:56.970085Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-06T19:18:40.154024Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.154024Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:b334c92e599719138fd6b4f30d383a670d7eddf95cf12eb1ace10c31dbaee2d0","observation_id":"7efef56f-9ccc-4f3e-b0c4-589bac84fd58","resolution":{"observed_at":"2026-08-06T19:18:40.154024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T19:18:40.283148Z","title":"Zico and Fredrikson, Matt.Universal and Transferable Adversarial Attacks on Aligned Language Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.283148Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:5cb65ec297b262eb7e748d68b2c6f6adf1184830b9b70247152c2c4ac13dfbc5","observation_id":"05f8fcb2-eb3f-441e-99f1-8a526aa9d2fe","resolution":{"observed_at":"2026-08-06T19:18:40.283148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-06T19:18:40.429244Z","title":"and Wong, Eric","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.429244Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:c3d56d0f56e45bae34eab5c3b3cc0bdf217b2d853c04304ea3dfdd31e3f84e2e","observation_id":"25f66079-b23c-41d8-b039-4b95459d3b93","resolution":{"observed_at":"2026-08-06T19:18:40.429244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06942","last_updated":"2024-07-23T06:47:13Z","snapshot_observed_at":"2026-08-06T12:56:48.193649Z","submitted_at":"2023-12-12T02:34:06Z","title":"AI Control: Improving Safety Despite Intentional Subversion","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06942","snapshot_observed_at":"2026-08-06T19:18:40.580182Z","title":"arXiv preprint arXiv:2312.06942, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.580182Z"},"links":{"cited_paper":"/paper/2312.06942","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:37d9251561a461dc41d079ef7fe3a4ab1bd4e5c38e43383d94293ebc7dfc2de0","observation_id":"cdba531b-0cde-4c13-b6f1-c526f77578c9","resolution":{"observed_at":"2026-08-06T19:18:40.580182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21792","last_updated":"2024-12-27T17:36:21Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:59:24Z","title":"Safetywashing: Do AI Safety Benchmarks Actually Measure Safety Progress?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21792","snapshot_observed_at":"2026-08-06T19:18:40.663885Z","title":"Kim, Stephen Fitz, and Dan Hendrycks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.663885Z"},"links":{"cited_paper":"/paper/2407.21792","citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:a26a09c8b5b7098c613e8748f4861db2a0d51607231a8da937aeb515a1ef3088","observation_id":"a53b041b-1dfd-4607-9626-78256768fe15","resolution":{"observed_at":"2026-08-06T19:18:40.663885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:18:41.297943Z","title":"Is this prompt harmful or not?","venue":null,"work_id":"781de4c6-de43-4e65-bbc6-626fb142c7b0","year":2025},"citing_paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:40.850181Z"},"links":{"citing_paper":"/paper/2507.06282"},"observation_digest":"sha256:616389e5bcda2982cb4d9ca1359b37d266d162ca2bdb62418df33d40d7ada4d3","observation_id":"15b373f1-d82b-4fc5-b86b-a2de051580f3","resolution":{"observed_at":"2026-08-06T19:18:41.442675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06282","last_updated":"2025-07-08T15:21:17Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-06T19:09:17.542317Z","submitted_at":"2025-07-08T15:21:17Z","title":"The bitter lesson of misuse detection"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":9},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 0 inbound Pith citation observations for arXiv:2507.06282."}