{"as_of":"2026-08-12T20:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:567094889040dc6894912d31d22e89cb8dfa5e04f9bde2f700f888ee03185275","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:34:36.614045Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T04:35:51.583460Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"cited_work":{"arxiv_id":"2501.08246","doi":"10.48550/arxiv.2501.08246","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.08246","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Text-diffusionred-teamingoflargelanguagemodels:Unveilingharmfulbehaviorswithproximity constraints, in: Proceedings of the AAAI Conference on Artificial Intelligence","venue":"ArXiv.org","work_id":"e7c3553d-b154-48f0-8c8e-4d9c9485502a","year":2025},"citing_paper":{"arxiv_id":"2606.26566","last_updated":"2026-06-25T03:32:12Z","snapshot_observed_at":"2026-08-03T17:22:40.185111Z","submitted_at":"2026-06-25T03:32:12Z","title":"Adversarial Diffusion Across Modalities: A Fusion Survey of Attacks, Defenses, and Evaluation for Text, Vision, and Vision-Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-26T04:35:51.583460Z"},"links":{"cited_paper":"/paper/2501.08246","citing_paper":"/paper/2606.26566"},"observation_digest":"sha256:7846b5ca32bfc21ec3db7ecb052916e09d634aadc737b9923feb0bb55726fe9f","observation_id":"8b94eda2-1069-43b9-baa8-93564a4f492f","resolution":{"observed_at":"2026-06-26T04:38:59.099988Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.08246/citation-record","integrity":"/paper/2501.08246/integrity","json":"/paper/2501.08246/citation-record.json","paper":"/paper/2501.08246"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.439847Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.439847Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:98dc677e1e5aa24bc6769e7bdcaef46d7efd14b0692c129e5e7deea1057c9adf","observation_id":"54713b1b-b6a0-4c6c-b60f-ea6166841c16","resolution":{"observed_at":"2026-08-10T20:34:36.439847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.444124Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.444124Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:f7a36c39b810ea20a692bd1effd9d4f445ec7e4d4d85bc99c6ff79af5046fe56","observation_id":"b4e231c4-3d29-4810-a314-3e3ad938df36","resolution":{"observed_at":"2026-08-10T20:34:36.444124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-10T20:34:36.447663Z","title":"L.; Almeida, D.; Altenschmidt, J.; Altman, S.; Anadkat, S.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.447663Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:bf4388bb2ac3f1f36cd6b46258dd9c2fcdfb9e621b3efa89cf4bb949fe6eb349","observation_id":"8f66ff6c-523e-4d0b-afda-50202acd4d96","resolution":{"observed_at":"2026-08-10T20:34:36.447663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.152058Z","title":null,"venue":null,"work_id":"e270dd70-a27f-4af0-b4f2-02cfa1a97ebc","year":2020},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.451582Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:607efb11732bb3f379f6ee3fa80fa28095f8d31a27c60de84b007d2bc23b1776","observation_id":"0b63ca7f-11d7-4f89-b660-ec083cdd001e","resolution":{"observed_at":"2026-08-10T20:34:37.155185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.141923Z","title":"D.; Ho, J.; Tarlow, D.; and Van Den Berg, R","venue":null,"work_id":"f5cef62d-a06c-454a-bef8-5e663a2de5b7","year":2021},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.455872Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:1518d9eee00f79aa9dd4327c4fba204b7f4a9e7e99ee5a8b3cd6a4710be25e37","observation_id":"90329bb6-e5bc-40ea-b4b3-1cbf8b197884","resolution":{"observed_at":"2026-08-10T20:34:37.145304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-10T20:34:36.460008Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.460008Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:d91e88f7a31e87687c2c2a60d9f4007e97280a69c81d3cfb2130410f9ed2052c","observation_id":"ea9cedbe-ee2a-4934-97d3-d2d2149f723d","resolution":{"observed_at":"2026-08-10T20:34:36.460008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-10T20:34:36.464699Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.464699Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:d75dfb0a10c6b1a04191e292c248ae5735a162662c11ea874c52f6cea291c707","observation_id":"df5430e5-3588-46bd-861c-d3a40ab04bbc","resolution":{"observed_at":"2026-08-10T20:34:36.464699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09442","last_updated":"2023-10-11T00:37:33Z","snapshot_observed_at":"2026-08-12T15:12:17.731789Z","submitted_at":"2023-06-15T18:49:50Z","title":"Explore, Establish, Exploit: Red Teaming Language Models from Scratch","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09442","snapshot_observed_at":"2026-08-10T20:34:36.468720Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.468720Z"},"links":{"cited_paper":"/paper/2306.09442","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:dcb0725eb855e41927e0b767bd78792429ea920ee167fc1c4eb07b1d6daeadf9","observation_id":"5340d82a-18b8-4cef-977d-3eee2b8506de","resolution":{"observed_at":"2026-08-10T20:34:36.468720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.130747Z","title":null,"venue":null,"work_id":"29e343d4-97a9-4f1c-97ad-398a5d517e81","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.473361Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:64b5469c80c071650ccb2e9d5a9463e7d2f5d63252f7695ce93f33255139e548","observation_id":"365c9c4b-56d9-4845-8b57-59c53a93cc69","resolution":{"observed_at":"2026-08-10T20:34:37.134654Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.117974Z","title":null,"venue":null,"work_id":"ba4ced62-bd64-48eb-8d93-47f99b2af53c","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.476547Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:41807722a1c15d36c8d01874f5d00cc27622d37a836c0dccffd3e8e30fe13a9d","observation_id":"1ba8fc20-1883-4e38-8485-745a623cc97a","resolution":{"observed_at":"2026-08-10T20:34:37.121822Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-10T20:34:36.481873Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.481873Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:e6c9e0d15596bb9bed70b1ba1a024c6e7b7c15ac2dc80c49fadbd1fd8cadde36","observation_id":"a0dacecf-ce7b-4d63-a703-1670304097b0","resolution":{"observed_at":"2026-08-10T20:34:36.481873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.106155Z","title":null,"venue":null,"work_id":"83aa35ca-a8fa-4ece-b65c-4fef90e257dd","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.486401Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:cc35ba80da23d6340fc90c100b136b91dba59665d6d40f297e5be2e59d7f566c","observation_id":"3f0d84e8-bcad-4345-a5de-bab64235c621","resolution":{"observed_at":"2026-08-10T20:34:37.110080Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07308","last_updated":"2024-05-02T14:28:39Z","snapshot_observed_at":"2026-08-10T17:53:09.843403Z","submitted_at":"2023-08-14T17:54:10Z","title":"LLM Self Defense: By Self Examination, LLMs Know They Are Being Tricked","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07308","snapshot_observed_at":"2026-08-10T20:34:36.490199Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.490199Z"},"links":{"cited_paper":"/paper/2308.07308","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:778f703b948b398000ccd2cca4be0fb345155c3a31b5b9f3e51ca1361e683b34","observation_id":"a508ff64-cec2-47e7-8263-495216ba1dcf","resolution":{"observed_at":"2026-08-10T20:34:36.490199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.092789Z","title":"R.; Srivastava, A.; and Agrawal, P","venue":null,"work_id":"b6b404e5-3540-4977-8598-f55b8381463e","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.494581Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:d8d551842a311837eaa6b38e7608c2f121f3fa893be599b67eaf927c52860b62","observation_id":"42437c03-9628-4384-9752-c57b2421d182","resolution":{"observed_at":"2026-08-10T20:34:37.097987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-10T20:34:36.498311Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.498311Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:6b187c31e22d31a572b2760fa3831c3e427c9f89d40f1f444bbfcf5b15b3b9b6","observation_id":"1cee21ef-7d17-4b59-ad84-6728e0ee1c14","resolution":{"observed_at":"2026-08-10T20:34:36.498311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.077987Z","title":null,"venue":null,"work_id":"9ab00a56-26aa-4a49-b221-5e051056409d","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.501953Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:11e3816c2c60cc50595fad0b4ddf00c3ea02a995f6214ea0ebed5fa0b7e645e5","observation_id":"b8fd3733-4d92-461d-9447-6f7fc399d0d7","resolution":{"observed_at":"2026-08-10T20:34:37.082435Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.066058Z","title":null,"venue":null,"work_id":"22f6c704-4a1c-470e-b8fd-c333a84a9676","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.505093Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:4f677544a2818da134cce1d097b4261dc2669b98942b38be5848c46e5a276ba9","observation_id":"b7c7188b-c6f3-4c8e-9eaa-4aa8181e4aaf","resolution":{"observed_at":"2026-08-10T20:34:37.069968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02705","last_updated":"2025-02-04T19:47:09Z","snapshot_observed_at":"2026-07-06T16:15:00.517258Z","submitted_at":"2023-09-06T04:37:20Z","title":"Certifying LLM Safety against Adversarial Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02705","snapshot_observed_at":"2026-08-10T20:34:36.508096Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.508096Z"},"links":{"cited_paper":"/paper/2309.02705","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:be57fc53c8e449894a3c07f5dfb86e869ecc3e5ac9b4ff4ce1340a5a5dd67191","observation_id":"ba88c8c3-1e8b-4b93-8a26-bc931f53e8bf","resolution":{"observed_at":"2026-08-10T20:34:36.508096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01446","last_updated":"2024-08-05T11:34:10Z","snapshot_observed_at":"2026-08-12T17:19:49.958976Z","submitted_at":"2023-09-04T08:54:20Z","title":"Open Sesame! Universal Black Box Jailbreaking of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01446","snapshot_observed_at":"2026-08-10T20:34:36.511940Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.511940Z"},"links":{"cited_paper":"/paper/2309.01446","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:08ac449500915232508715669f4ae2abf4ae3f628139b473d7ec3e8176a9421d","observation_id":"54d2cb09-86ff-4275-bceb-8c9463244fa4","resolution":{"observed_at":"2026-08-10T20:34:36.511940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07124","last_updated":"2023-10-09T03:34:01Z","snapshot_observed_at":"2026-08-12T15:37:59.192302Z","submitted_at":"2023-09-13T17:59:09Z","title":"RAIN: Your Language Models Can Align Themselves without Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07124","snapshot_observed_at":"2026-08-10T20:34:36.517547Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.517547Z"},"links":{"cited_paper":"/paper/2309.07124","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:5799f67a9659ad5b7213b446f1bd4579c5538fb3ce8170ac096dad5d8c7ae856","observation_id":"bcca81fd-e948-4fc2-824c-4aaca73527ce","resolution":{"observed_at":"2026-08-10T20:34:36.517547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.052263Z","title":null,"venue":null,"work_id":"7c6b2c81-b5cf-4550-811b-31f955a06cea","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.522205Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:af6dc70ceb2f5255deab26ee9fcfc3cd8726ddda5e2472ced299a1f23a670b4b","observation_id":"59dac234-869a-4c30-84a2-d8250452abd2","resolution":{"observed_at":"2026-08-10T20:34:37.056114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-10T20:34:36.526050Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.526050Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:1de9ad17e9916609c731211be9aef1a1f10d7c93014e508ad55723c7663bdd72","observation_id":"97868760-a7c4-4081-b7bf-50b7c8e79689","resolution":{"observed_at":"2026-08-10T20:34:36.526050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.040680Z","title":null,"venue":null,"work_id":"001e36c3-f10b-4725-8e2f-f0437417a6b2","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.530257Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:3873399245835b1cf5d3de635c70f1eeabfddbc95a97967cf304b0f56861d5ff","observation_id":"5912a16d-6e82-4c98-bdcd-d2ffc1d317c0","resolution":{"observed_at":"2026-08-10T20:34:37.044621Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04265","last_updated":"2024-11-07T14:23:51Z","snapshot_observed_at":"2026-07-06T16:03:54.971351Z","submitted_at":"2023-08-08T14:03:08Z","title":"FLIRT: Feedback Loop In-context Red Teaming","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04265","snapshot_observed_at":"2026-08-10T20:34:36.533947Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.533947Z"},"links":{"cited_paper":"/paper/2308.04265","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:bbf660fbcbc1dbdbc647a9ff9812b8679479a2d2b4bb446f04c77e727ce30da9","observation_id":"2fe14311-d545-4959-9c7f-6509a9fe045c","resolution":{"observed_at":"2026-08-10T20:34:36.533947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06816","last_updated":"2023-10-10T17:39:03Z","snapshot_observed_at":"2026-07-06T16:30:37.867641Z","submitted_at":"2023-10-10T17:39:03Z","title":"Text Embeddings Reveal (Almost) As Much As Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06816","snapshot_observed_at":"2026-08-10T20:34:36.537886Z","title":"X.; Kuleshov, V.; Shmatikov, V.; and Rush, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.537886Z"},"links":{"cited_paper":"/paper/2310.06816","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:12213eea2f557aa24f38a26f85c574d1293e80fc6449a15b3c4d156931176250","observation_id":"9f5f3076-d12d-4be7-877d-a3cb721e7ee2","resolution":{"observed_at":"2026-08-10T20:34:36.537886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.025939Z","title":null,"venue":null,"work_id":"857ffc13-299b-48ac-beec-5e4c81e77c22","year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.541504Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:84bc3b956258d63b4a8f9525720ba4e47ec98b94db4cdbce88238c010d030d80","observation_id":"2b6d4d1a-eb49-4399-9321-9c0f22a9660a","resolution":{"observed_at":"2026-08-10T20:34:37.031408Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-10T20:34:36.545509Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.545509Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:df5ac8896cd58b452e3af12d283c5c71a0eceaff6780bbb87c71ed4d50583910","observation_id":"2bad4ddf-be31-4a38-83f2-4a40210dcb9f","resolution":{"observed_at":"2026-08-10T20:34:36.545509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-10T20:34:36.548636Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.548636Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:2c6a3e86f70eb8e430d91c68e21f2a0714658e0a5b035da84aa7bb4476642c60","observation_id":"1292782a-a249-42d1-8d14-741e0fac3c20","resolution":{"observed_at":"2026-08-10T20:34:36.548636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:37.011800Z","title":"D.; Ermon, S.; and Finn, C","venue":null,"work_id":"4ff437dc-942b-478a-8d92-6f2d95fefcd4","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.552777Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:3b5020757a1be1495f03dc4a7832604e9ea588543a7812494b50c7ca60ba2773","observation_id":"39040c31-ea35-4e10-bf47-ccc48889ea73","resolution":{"observed_at":"2026-08-10T20:34:37.016562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.556919Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.556919Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:c0245c9f6aa533d80896f24b6f577cc184409144937491234c5393fe2239d778","observation_id":"0b5e7d15-7e94-4a22-9f8b-cf62af5066d1","resolution":{"observed_at":"2026-08-10T20:34:36.556919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-10T20:34:36.560590Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.560590Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:2416eb9112d9b82dd8589cd2d3d6daedf9a1e8eef4cfa5470b72971bf4f28ff8","observation_id":"cc77d5d7-d66b-416c-9a9d-16412cad66f4","resolution":{"observed_at":"2026-08-10T20:34:36.560590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10752","last_updated":"2022-04-13T11:38:44Z","snapshot_observed_at":"2026-07-06T12:20:47.369918Z","submitted_at":"2021-12-20T18:55:25Z","title":"High-Resolution Image Synthesis with Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10752","snapshot_observed_at":"2026-08-10T20:34:36.564455Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.564455Z"},"links":{"cited_paper":"/paper/2112.10752","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:4d09afc1831557b3bd40b51135a15fff1b6b9a441258ce24a5c572ab2f56f5c9","observation_id":"bb8bb8e6-3b15-4f39-b420-5965c6196b17","resolution":{"observed_at":"2026-08-10T20:34:36.564455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12950","last_updated":"2024-01-31T19:47:26Z","snapshot_observed_at":"2026-07-06T16:10:07.931347Z","submitted_at":"2023-08-24T17:39:13Z","title":"Code Llama: Open Foundation Models for Code","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12950","snapshot_observed_at":"2026-08-10T20:34:36.568671Z","title":"E.; Adi, Y.; Liu, J.; Remez, T.; Rapin, J.; et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.568671Z"},"links":{"cited_paper":"/paper/2308.12950","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:df83c83a9902a592ddb5e9cba89668d17aa1ed16ee64afa85944a658c664988c","observation_id":"161187d3-57f3-4263-b381-71953cf35b88","resolution":{"observed_at":"2026-08-10T20:34:36.568671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-10T20:34:36.572888Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.572888Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:d24f9ed2de7d4a7e1297ee56289b8090b58d53271e841f20263c03f79f0a5c91","observation_id":"22babea3-4a10-486b-9d02-f0b1a4cd12dd","resolution":{"observed_at":"2026-08-10T20:34:36.572888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17680","last_updated":"2023-11-01T17:30:47Z","snapshot_observed_at":"2026-07-06T16:39:08.850847Z","submitted_at":"2023-10-26T11:06:15Z","title":"CodeFusion: A Pre-trained Diffusion Model for Code Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17680","snapshot_observed_at":"2026-08-10T20:34:36.576095Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.576095Z"},"links":{"cited_paper":"/paper/2310.17680","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:9b5f1b0f80da00a15e8a934cf947dfed5cf3a3b97dd8da4ebe1d12f369a6e160","observation_id":"92c0e8a5-cfd6-4441-83d2-11bc8389e9a8","resolution":{"observed_at":"2026-08-10T20:34:36.576095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.991954Z","title":null,"venue":null,"work_id":"e8d6645e-4d73-4244-8350-f5604cc2c865","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.579420Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:d4249ce6328baa485d18aece0505033c64b543604cc5d28375ad7807236d065d","observation_id":"596bda71-a020-47ce-a070-baf05566a54d","resolution":{"observed_at":"2026-08-10T20:34:36.996260Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.979307Z","title":null,"venue":null,"work_id":"c8367476-88da-4b32-a50f-d95cf3498580","year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.583198Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:cf3b0aed0c0e45c1b457e8f4a5b304e20dbc7aad35319b9a3deb126bf5aa4ce7","observation_id":"9c6e9b4e-ab85-4bb0-b9e7-408b60693cfe","resolution":{"observed_at":"2026-08-10T20:34:36.983209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-10T20:34:36.586454Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.586454Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:63fd7367dc4392f7b8191f0a8735db3139d70962a1b7c0621df39d18819be1d5","observation_id":"9f0d3bbc-1be3-408c-8337-e4e944dcfdb1","resolution":{"observed_at":"2026-08-10T20:34:36.586454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.968252Z","title":null,"venue":null,"work_id":"9a0df0bb-f0c8-4edd-bca9-10d5444a5d2e","year":2020},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.590996Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:056d9807798a847d23a617faaf961edde369abb5e25cc984d301a0f1f7a5d026","observation_id":"408691c8-4fcf-47c4-992b-30b4d11bb299","resolution":{"observed_at":"2026-08-10T20:34:36.971614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.957412Z","title":null,"venue":null,"work_id":"5b13025a-8e45-4ce7-ac95-b0e13ceca082","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.594905Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:189834f42287adde1fd1c38f09b15a794d7d8f68974dc618b3669f0153b2a622","observation_id":"32e7b1e0-9d08-46f3-aaed-e34e0bcf68c3","resolution":{"observed_at":"2026-08-10T20:34:36.960929Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16656","last_updated":"2024-01-30T01:19:25Z","snapshot_observed_at":"2026-08-09T23:54:56.266650Z","submitted_at":"2024-01-30T01:19:25Z","title":"Gradient-Based Language Model Red Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16656","snapshot_observed_at":"2026-08-10T20:34:36.598963Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.598963Z"},"links":{"cited_paper":"/paper/2401.16656","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:5735ef111844faeedbad177d95efeb9f28d80cb4170eca1c8d9bf7539a03236d","observation_id":"de2478ee-3330-46b2-a4d4-58b0c3350eda","resolution":{"observed_at":"2026-08-10T20:34:36.598963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-10T20:34:36.603073Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.603073Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:08bc148af42a2a82927b75c39fc79854d9e79509f8d55f26bc55598286dab33e","observation_id":"b95ecf7d-e00e-4012-a4b9-cbdb8aefe43f","resolution":{"observed_at":"2026-08-10T20:34:36.603073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.944454Z","title":null,"venue":null,"work_id":"97a90d8f-7a58-4191-9292-92276902b4ad","year":2019},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.607088Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:85498afa21742d6b575d2184bb5851db6167b6202d3520e02ddf8f83bf7493cf","observation_id":"5e97bd6b-7191-4497-8b0e-d60ff53edae0","resolution":{"observed_at":"2026-08-10T20:34:36.948972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:34:36.927270Z","title":null,"venue":null,"work_id":"d061a86d-8628-4ebe-9c68-4e712b17a991","year":2024},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.610692Z"},"links":{"citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:a5ac6db532a8a86bf98e5c2c999d5667b6140ffd55adbe7e45d5b1c7961f378b","observation_id":"a1cd0671-ac73-47b2-9da3-611800a9012a","resolution":{"observed_at":"2026-08-10T20:34:36.933891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-10T20:34:36.614045Z","title":"Z.; and Fredrikson, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-10T20:34:36.614045Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2501.08246"},"observation_digest":"sha256:c8bd7427d3c17a7c462def107311b37619ebaba6ce6a5f6df2779a3f4293ea85","observation_id":"5679ae28-7e14-4d6e-9ab1-7a0b64e619dd","resolution":{"observed_at":"2026-08-10T20:34:36.614045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.08246","last_updated":"2025-01-14T16:32:01Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T15:12:51.342275Z","submitted_at":"2025-01-14T16:32:01Z","title":"Text-Diffusion Red-Teaming of Large Language Models: Unveiling Harmful Behaviors with Proximity Constraints"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2501.08246."}