{"as_of":"2026-08-08T04:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:24ac0301b93e96bf1b4d5d5c5a615e684e53e79490dce26581f3b325eeff060a","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:32:27.923260Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03985/citation-record","integrity":"/paper/2509.03985/integrity","json":"/paper/2509.03985/citation-record.json","paper":"/paper/2509.03985"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.788534Z","title":"Alain and Y","venue":null,"work_id":"d2f50360-7ecd-4054-8012-58bd14aa8ccc","year":2017},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.680727Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:82669d991b5e424e93d7e2faf6d290a6d34aa7a1d36aa6fcf38553d88be79b5d","observation_id":"bc7f86b7-9884-477d-a1bc-d62e887a0e6e","resolution":{"observed_at":"2026-08-05T10:32:28.792238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.777959Z","title":null,"venue":null,"work_id":"c4124d2f-9fb9-46d3-8221-1b5980e83033","year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.683928Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:774ca81a24c9355c2825a26a3675df1d26ab7b51d4d918e8de280a1ac187adf3","observation_id":"d142f639-1852-4c90-ac36-291d31fc9722","resolution":{"observed_at":"2026-08-05T10:32:28.781958Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09289","last_updated":"2024-10-05T19:56:20Z","snapshot_observed_at":"2026-07-06T18:30:28.421247Z","submitted_at":"2024-06-13T16:26:47Z","title":"Understanding Jailbreak Success: A Study of Latent Space Dynamics in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09289","snapshot_observed_at":"2026-08-05T10:32:27.687194Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.687194Z"},"links":{"cited_paper":"/paper/2406.09289","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:efd8f19f028979019fe0439ee2214bba2603279c3ee0b6963c5c064ffa2c0900","observation_id":"6e19f11a-9ecc-4966-819d-6c4b8ca4132f","resolution":{"observed_at":"2026-08-05T10:32:27.687194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.767373Z","title":"Bereska and S","venue":null,"work_id":"aef66af0-6ee1-4fee-8e4b-b2e8e6ceda18","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.691149Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:cd884841529914eb002e9eb3f6636c809669e9e160eae886406f33feb89b196e","observation_id":"33d87c9b-ddf0-4e41-a366-073bcdf5eadf","resolution":{"observed_at":"2026-08-05T10:32:28.770823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.758736Z","title":"Bilal, A","venue":null,"work_id":"2ba7fdb2-b957-4701-8d1d-a6a66cd81a02","year":2018},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.694205Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:cf73035f94f4ebbfe3b5849755cfe7e6e8a5c91779f0b221dcc81438cc97082b","observation_id":"156a9460-4642-444d-8ed1-99becdaa72e9","resolution":{"observed_at":"2026-08-05T10:32:28.761481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.750343Z","title":null,"venue":null,"work_id":"2ba374c2-430f-4f51-ba42-a5ecc5029e4d","year":null},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.697115Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:50fc82a522733f95609dc7be2fa892015ddd7d1afd1fc9d34992ff73259ef687","observation_id":"bfa34699-29ec-4cf5-befe-03f3ef8401a3","resolution":{"observed_at":"2026-08-05T10:32:28.753010Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.741677Z","title":null,"venue":null,"work_id":"d9cdc4b8-e486-4d0d-bf6f-5a3fdae662dc","year":2021},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.701118Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:7fba7bdc591215c35ec34227b683411dde02168a451e80f6d921643c1bbf69b1","observation_id":"5ad2a9a4-759b-46a4-8a10-e89e4f41400f","resolution":{"observed_at":"2026-08-05T10:32:28.744187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.732037Z","title":"Testing with concept activation vectors (tcav) on sensi- tivity classification examples and a ConvNet model trained on IMDB dataset","venue":null,"work_id":"963c0d88-09f2-4857-9717-5c456a11428e","year":2022},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.704427Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:e29a6258b23017482a8cb9819c6299b16627ddbae88a8637506a5517a2e8452f","observation_id":"a7901187-d871-48af-8743-00b1972c49f6","resolution":{"observed_at":"2026-08-05T10:32:28.734972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.722762Z","title":null,"venue":null,"work_id":"2818557a-af9a-4772-a05f-9afc7f69d4c8","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.707181Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:459b2b0e1aa975ed5e29051e5fbd605328628b8f40d96f9d43121e96c93e1e08","observation_id":"1e0bf578-c950-49e6-8fff-9f78dadcb409","resolution":{"observed_at":"2026-08-05T10:32:28.725291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-05T10:32:27.710794Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.710794Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:2c4e8402d4b658f22e674a1230798baefa35b3332bdd7f3bafb6889b6ab0d236","observation_id":"a1d192b0-0b48-4896-a6c2-1f9d0ff82f0b","resolution":{"observed_at":"2026-08-05T10:32:27.710794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:27.713806Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.713806Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:85559deaca2b8be78b3f5a398b66777f7b79acfc7567118a252f646d6a386a64","observation_id":"2fa91908-9e40-4692-9ae9-a4475afa1018","resolution":{"observed_at":"2026-08-05T10:32:27.713806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.714145Z","title":null,"venue":null,"work_id":"e68a6001-968f-43da-8eaf-ab1006783966","year":2025},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.716127Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:9dd3325f243a6d4a96dc7d785a8fe26f1b1c62d2cd23c45c6e34d722e15a3ce1","observation_id":"50ba8257-3052-47d7-8108-d3573af15854","resolution":{"observed_at":"2026-08-05T10:32:28.716997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.705160Z","title":null,"venue":null,"work_id":"850a2710-a2b0-4f15-955e-05f51c3a9f8a","year":2025},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.719024Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:3f1826ede09988927f3bcf446aa8d849d698eb76956652e5d66b71ec309eeed5","observation_id":"4e1bb4e7-0499-4bc8-8075-0fa71d24618e","resolution":{"observed_at":"2026-08-05T10:32:28.707959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.695654Z","title":null,"venue":null,"work_id":"41967cd9-3651-4ee6-815e-7fbe3e107c2e","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.721533Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:6ba811f8f2666982cb8d50e48acc91594050ad5e0c0b39f9c98ff3c813eb0ea0","observation_id":"2ca32614-f409-43d7-a634-e14c5f82eee9","resolution":{"observed_at":"2026-08-05T10:32:28.698613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.686122Z","title":null,"venue":null,"work_id":"21e7ef1f-cb2b-437e-9bbf-33beef09218c","year":2021},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.724114Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:2afb2fa20b16d8b89e036c9e2d8cbc1ff817cc3e625af5bd1b8d54e6bb91aeff","observation_id":"a883ca6b-ca13-4576-886d-5c718ab4c25f","resolution":{"observed_at":"2026-08-05T10:32:28.688930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.676641Z","title":"Ethayarajh","venue":null,"work_id":"14552810-0925-4310-9636-f393620a84ef","year":2019},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.726484Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:e1078ed8882252fbfa1e7eba52729bca8de42f666f422bbebeec06b343630347","observation_id":"5cb16f78-3993-483f-8d2e-7f74cbb24a3f","resolution":{"observed_at":"2026-08-05T10:32:28.679909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08793","last_updated":"2025-06-06T20:39:01Z","snapshot_observed_at":"2026-07-06T17:59:38.202928Z","submitted_at":"2024-04-12T19:54:42Z","title":"JailbreakLens: Visual Analysis of Jailbreak Attacks Against Large Language Models","version":2},"cited_work":{"arxiv_id":"2404.08793","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.08793","snapshot_observed_at":"2026-08-05T10:32:28.093587Z","title":"JailbreakLens: Visual Analysis of Jailbreak Attacks Against Large Language Models","venue":"cs.CR","work_id":"70dd0404-0adc-4864-8ed5-a018e66ec964","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.728830Z"},"links":{"cited_paper":"/paper/2404.08793","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:3a2ccfc4c6feebb4d1a795d0de16270ecca78e4a38d9ac3f4eac9d7357d93fa3","observation_id":"9da651fb-8032-4e27-9585-c0b07320993e","resolution":{"observed_at":"2026-08-05T10:32:28.096995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11114","last_updated":"2025-04-24T03:38:08Z","snapshot_observed_at":"2026-07-06T19:51:37.262377Z","submitted_at":"2024-11-17T16:08:34Z","title":"JailbreakLens: Interpreting Jailbreak Mechanism in the Lens of Representation and Circuit","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.11114","snapshot_observed_at":"2026-08-05T10:32:27.731531Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.731531Z"},"links":{"cited_paper":"/paper/2411.11114","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:01c8fe328f168ef9f0c84a3399238443720638d84304837d99b7481ea60479b9","observation_id":"e7b93f94-ee25-4fca-9e21-9d33ae828b92","resolution":{"observed_at":"2026-08-05T10:32:27.731531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.667003Z","title":null,"venue":null,"work_id":"d22921ba-47a4-49ae-9957-3f075cb75777","year":2022},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.734757Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:564e358022aaa1060dc3973717885e5b19c15327714bb67df123d675375bcb73","observation_id":"d4e91290-1798-49ff-8444-7c3aed14a5d7","resolution":{"observed_at":"2026-08-05T10:32:28.670369Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.657175Z","title":null,"venue":null,"work_id":"844a703f-1153-4c02-af34-c497bd53fb4c","year":2025},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.738183Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:dbf1288be9872c3aa56e3ee1d6a682ec43c3f9757f53c9cbb5a4412fded5e5c1","observation_id":"f2ca5c3d-60fb-42da-89b8-8b360dcc3c6b","resolution":{"observed_at":"2026-08-05T10:32:28.659670Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.648891Z","title":null,"venue":null,"work_id":"e245752d-2749-4ffe-805d-57bf49262a6c","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.742293Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:d62f52b4c702bb250daae5cf3f5c6c41305ab2f346eb148e30d6b5ef48c2e34d","observation_id":"3610879d-a107-410c-8477-aaf901d8252a","resolution":{"observed_at":"2026-08-05T10:32:28.651497Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.640420Z","title":"Kahng, I","venue":null,"work_id":"4696c925-0c32-47be-b7de-8e4c557cd6ef","year":2025},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.744746Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:69513cb688cca6550b4271df7eb833f0d0310da5381031a3fe22797cd5c1b8b1","observation_id":"1ce3491c-996b-4749-a8fc-54ed45af5d3b","resolution":{"observed_at":"2026-08-05T10:32:28.643317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.630268Z","title":null,"venue":null,"work_id":"1e357c38-d83d-4138-9b0a-01d036b6c9c7","year":2018},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.748166Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:4986d4c29c9c478623c609b326330ad2fb07d846fc87e4283e96dd3c4ea9777f","observation_id":"ec49ab38-e787-4fc3-9ee2-c99cc3f0acd0","resolution":{"observed_at":"2026-08-05T10:32:28.634557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.620315Z","title":null,"venue":null,"work_id":"5d8c7ecc-ab6e-4e9e-b3fa-569bcbc6667f","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.750776Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:064d5301c7253b4b8fd63db0bb40139e935b66d06dd4cc5f0db272972a30ea79","observation_id":"a5d064d2-4848-4993-96ef-6d9f335fec58","resolution":{"observed_at":"2026-08-05T10:32:28.623198Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20624","last_updated":"2024-05-22T08:39:46Z","snapshot_observed_at":"2026-08-02T03:56:52.247351Z","submitted_at":"2023-10-31T16:55:06Z","title":"LoRA Fine-tuning Efficiently Undoes Safety Training in Llama 2-Chat 70B","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20624","snapshot_observed_at":"2026-08-05T10:32:27.753084Z","title":"Lermen, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.753084Z"},"links":{"cited_paper":"/paper/2310.20624","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:b9a877c0b007647f2c27ee543765d8ed8c1284711c72ac330fe7257a28e6cd55","observation_id":"f0230405-d481-4232-a71e-a6bd91d0f21a","resolution":{"observed_at":"2026-08-05T10:32:27.753084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.610761Z","title":null,"venue":null,"work_id":"c2bdc4ed-e9b9-4938-9376-de6b30126a4e","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.756029Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:3603da1e1903287f9bd8e5c29ee43e15680117270649859f3a1ddf36fdc57528","observation_id":"a75a478f-ae0a-4f69-9c65-ad0db345ad8d","resolution":{"observed_at":"2026-08-05T10:32:28.613620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.601507Z","title":null,"venue":null,"work_id":"1e0a3367-c3e3-477a-a65b-f7858f37bb29","year":2025},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.758635Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:1350a0252f8ee456a2bab2cdc1a560c009b950728dadfe4dd863ca8b8f47681c","observation_id":"c156e39e-22dd-4518-82df-74f3e5f7850b","resolution":{"observed_at":"2026-08-05T10:32:28.603982Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.591609Z","title":null,"venue":null,"work_id":"5a603215-b5ec-4e24-8225-24c024e8bca1","year":2025},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.761114Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:dbb9209bef630da1b83c4a0f8279db683fb6d21fb8a593e038810dcb3e45155f","observation_id":"ea885a24-d3b3-4df9-8ef8-fb2c4f7ce507","resolution":{"observed_at":"2026-08-05T10:32:28.594166Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.582531Z","title":null,"venue":null,"work_id":"150f75ee-3ed9-4947-8eab-9ef8b428b3ea","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.763850Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:a79abcf85998bc4b5a8847c25767dd874ad530133377d710dadbd7005556cf51","observation_id":"601e7e64-8353-4560-8c92-c8105fcd86a0","resolution":{"observed_at":"2026-08-05T10:32:28.585111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.573204Z","title":null,"venue":null,"work_id":"a63cf083-42be-4d0f-a454-ddbc04164015","year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.766141Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:15b97e0af9bf35cd6732c5e2bd4051586b7f15c15ea0176e8f7bd3b4ca7e7c53","observation_id":"8b3f8815-396b-4cc3-8103-45aa791ddd58","resolution":{"observed_at":"2026-08-05T10:32:28.575720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.563888Z","title":null,"venue":null,"work_id":"2645aca2-5e09-49cc-9d2b-95fd8fbd0755","year":2022},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.769893Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:35dd900b9beb866972902e2633b8a0da8d25ce50e526c6d574a47e60191fc5eb","observation_id":"ca82fa06-5c9d-4d80-80c1-c2bff785c9aa","resolution":{"observed_at":"2026-08-05T10:32:28.566501Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.555482Z","title":null,"venue":null,"work_id":"26782bc9-00d4-4404-b626-f36aaaf2b9ca","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.772989Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:6e8347664f469d06f27e7c5cb78fcccf76582025097dceb7cef249683dd09970","observation_id":"5b604595-b116-4e20-bc80-4cef3e95923f","resolution":{"observed_at":"2026-08-05T10:32:28.558302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.546584Z","title":null,"venue":null,"work_id":"37fff165-df5b-49c1-93a6-6586b94a04a8","year":2017},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.775544Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:d23bc2a799ea95f869c57dbf8d37799f4921be464001801d304aa5df6ed46c19","observation_id":"46ffef53-cd3f-4959-b458-9295113384e2","resolution":{"observed_at":"2026-08-05T10:32:28.549115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.536336Z","title":null,"venue":null,"work_id":"1ec14c1d-baff-48c4-8bf3-f6b93245bbcf","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.778386Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:9d8a566949636a79bf03c87573e032b83134791a29fe212076ec24048a7063c9","observation_id":"a325b695-2d66-4342-9131-972cd5660cf2","resolution":{"observed_at":"2026-08-05T10:32:28.539610Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.525647Z","title":null,"venue":null,"work_id":"18813378-9b27-4dcc-9e34-125a38be75e6","year":2020},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.781022Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:04cebd5cb08e508f94177936aa571c326a7d2c59ce7a5d504d0de1bbd2d59b92","observation_id":"9a78b354-97ac-4aab-be7a-7e62e55cc1c2","resolution":{"observed_at":"2026-08-05T10:32:28.528776Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.515203Z","title":null,"venue":null,"work_id":"0dee51de-aa2a-4f49-ab76-e34a658dc00d","year":2017},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.783830Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:f2aea33616411c31d7b14012a619a66978631a97e49714837b37e38fa1534ff0","observation_id":"8ec74725-1ff2-444e-9db5-e3cea5cc7122","resolution":{"observed_at":"2026-08-05T10:32:28.518417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.504402Z","title":"Interpreting gpt: the logit lens","venue":null,"work_id":"37158859-6132-4440-ad8c-1479537087fe","year":null},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.786269Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:b37762fa38eb430f7c31f0262c6923ac26ca4b9009403e70f2942f755925c4f2","observation_id":"173ae302-0310-4ccb-ad3a-0c0ae016f145","resolution":{"observed_at":"2026-08-05T10:32:28.507990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.484337Z","title":"Ouyang, J","venue":null,"work_id":"4afb022f-cc0e-45c2-8ba3-fc38b0fdd408","year":2022},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.793623Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:a0f89b2a280c10efac2f77d0906a2f24a6deb4379c1f47f84196272923a515e2","observation_id":"c0062f85-0c57-4dc9-bf41-14a727a5b465","resolution":{"observed_at":"2026-08-05T10:32:28.487439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.475497Z","title":null,"venue":null,"work_id":"64d266bc-e0c9-4edc-b929-053dd6323335","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.796018Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:6dd2f99ebfcfa033768ff3d0641e823ccf96b034782951095656b32938db3ed6","observation_id":"00a8bb78-727a-40d7-bac9-b11818e88a68","resolution":{"observed_at":"2026-08-05T10:32:28.478541Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.465135Z","title":"Radford, K","venue":null,"work_id":"348b6cfe-115a-4574-8829-2a5e11b6c6d8","year":2018},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.801282Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:aea8fd6b74ebb95ffe1576e1a320baf1cf1745fde1369598437c6e41f134b8b2","observation_id":"d9c49b2d-d975-49cb-8daa-8d7254987b07","resolution":{"observed_at":"2026-08-05T10:32:28.468250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.454159Z","title":null,"venue":null,"work_id":"9ee6ca46-7ade-4fd9-8ce9-683b8335559f","year":null},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.808110Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:64db6a07baf6f7284ad89507c55e26f200d52493f30a4a02f6de5c4304619986","observation_id":"ef79769f-2bf3-443e-bbf9-f5f2e5ba69ea","resolution":{"observed_at":"2026-08-05T10:32:28.457114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.442985Z","title":"why should i trust you?","venue":null,"work_id":"30044b34-ca8b-4ba0-9f48-6bb8307edf37","year":2016},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.811980Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:5ddb0ccc6a8591ac61f92b7e80fd0ee84ff2fb02284ea3e1702995f4b4efec76","observation_id":"934ae3ca-79d1-41fb-bf2d-be019084c85b","resolution":{"observed_at":"2026-08-05T10:32:28.446241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.432848Z","title":"Sevastjanova, A","venue":null,"work_id":"2eff7f9f-580a-4dfb-9a43-203e2da2b1da","year":2022},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.814943Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:07d820edda11084eb86b522a1941261e6587a1d98d80a9160ca3cce755ee0a32","observation_id":"b83f1669-70ad-4bc1-915d-77cf09422a30","resolution":{"observed_at":"2026-08-05T10:32:28.435532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.423418Z","title":null,"venue":null,"work_id":"882fd141-63f4-4806-ba10-afcc95ce9237","year":null},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.817757Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:47094ee84748a3be9fcd8ed4319a1eea3a9172ca430db9ab6e332ed94a16fc72","observation_id":"3925d3f2-269e-4b3f-9431-f1f9ebc59baf","resolution":{"observed_at":"2026-08-05T10:32:28.426257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.413041Z","title":"do anything now","venue":null,"work_id":"7abf79a4-d1ea-46a5-9dc5-06bd66b8f8e6","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.821079Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:1f32e9ddbe3fd176718779e77601b5576f4d9791691a2bf3691a8761affeee90","observation_id":"bcf30fd0-7b91-42fa-947b-8c76f57680ff","resolution":{"observed_at":"2026-08-05T10:32:28.416020Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.404984Z","title":"Strobelt, S","venue":null,"work_id":"5d5f1f46-05fe-426b-8abf-5cd7c9f17c75","year":2018},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.823963Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:32de56f60d332913fb21a39e70b51a065b7188326f51b13c367f3a9a707432e7","observation_id":"8e78a33d-aade-4f21-84fe-dab05547085d","resolution":{"observed_at":"2026-08-05T10:32:28.407760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.396007Z","title":"Strobelt, A","venue":null,"work_id":"cad9aca6-14cd-487f-93bf-db95a8fdf33e","year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.826748Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:caa0d262ecad359327eb16df7b56ad792ee3ba7ea81df0c8a1135c394a24d3cd","observation_id":"95cea24b-abf7-49a6-bb19-6ff8c2ded78b","resolution":{"observed_at":"2026-08-05T10:32:28.398675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.385637Z","title":null,"venue":null,"work_id":"9057144c-942b-46b9-95ad-b459a837a248","year":2022},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.829968Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:5ab80911589f1bcda6a136a5ffc1cf5ab3bbc11ccb6ed0ee6a23313d68d5fca7","observation_id":"bd19a000-7574-45df-aa8d-086ef8d912e5","resolution":{"observed_at":"2026-08-05T10:32:28.388576Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.376501Z","title":null,"venue":null,"work_id":"536510dd-85c6-47fa-80f8-2b7d1535ea7f","year":null},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.832825Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:b73945a4c369a961745ac72de6975944dbdde42497cccd4f8311f0fd8a4d238a","observation_id":"44fee4d9-d345-48e9-a710-58fbffa90bc5","resolution":{"observed_at":"2026-08-05T10:32:28.380081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.368315Z","title":"Taori, I","venue":null,"work_id":"642ab888-7d88-4d31-93bd-41275baee20d","year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.836041Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:32321e8944c07aeec7ed9dcf2c04caa9ec748af03e03bb0e65b9713363384224","observation_id":"aecd48a2-9f82-44a6-b684-1a3333161910","resolution":{"observed_at":"2026-08-05T10:32:28.370995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.360017Z","title":null,"venue":null,"work_id":"785a26a9-3883-47b0-bace-276f5f7459f3","year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.838909Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:2b9c1e5acf24704bb33346eb28ab1aac4d983028be8b10634f1ee7645f560684","observation_id":"5b81cef1-a789-4079-9977-dcc600f2e06f","resolution":{"observed_at":"2026-08-05T10:32:28.362922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08676","last_updated":"2024-06-24T08:50:22Z","snapshot_observed_at":"2026-07-06T17:59:29.408432Z","submitted_at":"2024-04-06T15:01:47Z","title":"ALERT: A Comprehensive Benchmark for Assessing Large Language Models' Safety through Red Teaming","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08676","snapshot_observed_at":"2026-08-05T10:32:27.841762Z","title":"Tedeschi, F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.841762Z"},"links":{"cited_paper":"/paper/2404.08676","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:5bdb6413e624e96cc18ab6ef6326224f5cecfefb831c97281efdce82459d329d","observation_id":"b7245038-369d-47bd-bb22-f7293bf9c6a6","resolution":{"observed_at":"2026-08-05T10:32:27.841762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.350918Z","title":"Vaswani, N","venue":null,"work_id":"5adce1c0-3e70-40c1-881a-ebffe0198fc3","year":2017},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.847712Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:279fa9f31ca10555d6a76a57e137ee358bc3d4d7e34371421614979dfe0199f1","observation_id":"f76105bf-f3f2-475e-8cdb-74aa088c5e4c","resolution":{"observed_at":"2026-08-05T10:32:28.353314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.342225Z","title":"Vig and Y","venue":null,"work_id":"75b7697f-bb29-4084-a3c5-c85bac8d050f","year":2019},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.850725Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:f81ae0ca1b751c4279e9923c960f5fd64032754c2ff117906e7f7bb1d7a75de0","observation_id":"a66bfc23-072b-4ba1-9323-8250a09fd00f","resolution":{"observed_at":"2026-08-05T10:32:28.344716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.332790Z","title":null,"venue":null,"work_id":"1e16c39a-e9d0-4145-9191-0a077929920f","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.853817Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:2c4d1458cd4c0fd25b9eeaf00892f475787342a453faadf3a78b65c78a399e50","observation_id":"20409ec0-cf4f-445b-8cbe-5a3c71730eff","resolution":{"observed_at":"2026-08-05T10:32:28.335354Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.323823Z","title":null,"venue":null,"work_id":"f5b1e12d-5e0b-4561-9bfe-4b20169e13e5","year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.857410Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:df67c63085b0395b699560b2f531b12d7f28e7fd993d8ccd99c6d91eba8cd8bd","observation_id":"4f7ea171-edc5-497f-a9f8-304772d99395","resolution":{"observed_at":"2026-08-05T10:32:28.326945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:27.860436Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.860436Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:bd6fc8c82de03dfbada732bd18a8b664db6ea3e79fe9db7f82e60d6dc82c2d9b","observation_id":"89b75ed9-355a-4b56-8ef6-f0fcf5a8342b","resolution":{"observed_at":"2026-08-05T10:32:27.860436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.315950Z","title":null,"venue":null,"work_id":"ccf47bf0-e457-49ef-8b66-5eff686bf87a","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.864012Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:cc1f62dd6968c8d4d67cdc3585063fd83f3c9149861340a5ba06f0f3fe5c4fa7","observation_id":"36ea7b79-b485-43b3-a8f7-08df6fe17f95","resolution":{"observed_at":"2026-08-05T10:32:28.318664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.307531Z","title":null,"venue":null,"work_id":"9ab6f499-fa92-48be-9a13-29bebb4f5e71","year":2021},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.868553Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:331d6413a3218774227e0403687bbaf0d74d4927706cfe41bacddd4a831cd06e","observation_id":"ccd12b96-2371-454e-9f4b-81006888be78","resolution":{"observed_at":"2026-08-05T10:32:28.310094Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.299025Z","title":null,"venue":null,"work_id":"f6bbb782-21d5-4fe0-a2ea-eab2d909e80b","year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.872280Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:6aea3b2a087ce280d8664beddfb4e8b27adbfd43f101c133f0f61e2cbd0198c1","observation_id":"dd7f7759-9422-45a3-8a87-70475940b3fc","resolution":{"observed_at":"2026-08-05T10:32:28.301916Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.289941Z","title":null,"venue":null,"work_id":"9fe02497-3a7d-40d6-a62d-5f8d711271bc","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.875534Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:b842b8acfab600a709f9fd50ee4b2f6267f024c8c5fc70ab4caeabe828062175","observation_id":"0c8b023a-9f21-420f-9bb0-f5f75aeff957","resolution":{"observed_at":"2026-08-05T10:32:28.293041Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.280373Z","title":null,"venue":null,"work_id":"04e48b64-da96-43e3-acdf-2b077d362d34","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.878567Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:54f13a1a6f604d1f9b954050c018e575307543a7cf32bab8fc3a27a46bb748ea","observation_id":"36a73bd2-e624-43ab-97a2-f862cda7f63f","resolution":{"observed_at":"2026-08-05T10:32:28.283060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.271683Z","title":"Weidinger, J","venue":null,"work_id":"a76520f7-3315-4156-8a86-c659b25a86a3","year":2022},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.881358Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:2e87da1480eb5290ce1673b59b66113344c892dd8cb79e7c0894a8db44db1726","observation_id":"a03b786d-baac-4f3d-80dc-97a0ca61200c","resolution":{"observed_at":"2026-08-05T10:32:28.274500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00196","last_updated":"2021-01-01T08:45:32Z","snapshot_observed_at":"2026-08-07T02:10:25.451531Z","submitted_at":"2021-01-01T08:45:32Z","title":"On Explaining Your Explanations of BERT: An Empirical Study with Sequence Classification","version":1},"cited_work":{"arxiv_id":"2101.00196","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.00196","snapshot_observed_at":"2026-08-05T10:32:27.986436Z","title":"On Explaining Your Explanations of BERT: An Empirical Study with Sequence Classification","venue":"cs.CL","work_id":"d362fb58-b052-4cb2-979a-739238d89680","year":2021},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.884680Z"},"links":{"cited_paper":"/paper/2101.00196","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:e1852cdfa3dc47745122b3100f18d598ab81ab16ace8b03ae0f27e3a36b03e98","observation_id":"4dafdc3c-d4ef-4793-8516-2012df4dd1c9","resolution":{"observed_at":"2026-08-05T10:32:27.992557Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.261907Z","title":null,"venue":null,"work_id":"4a83bb6d-a157-4156-afe4-eaa0c8c3afab","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.888036Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:30c95fff0e6bfec6ede464ebd850496b6764a20888a1036004e676d5a126479d","observation_id":"96600f85-fa91-4e84-aa59-a1c2f47c9a5a","resolution":{"observed_at":"2026-08-05T10:32:28.264967Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.253358Z","title":null,"venue":null,"work_id":"c5b28197-bfe3-4ed1-bc15-7fa26c796c33","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.891443Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:e1a7feba8ded2918f20e6023eef39e36b57fbce839acb08ce11bf3addee4a13a","observation_id":"78404cfe-0ba8-46c3-9e1a-8910060f1247","resolution":{"observed_at":"2026-08-05T10:32:28.256228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04295","snapshot_observed_at":"2026-08-05T10:32:27.894549Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.894549Z"},"links":{"cited_paper":"/paper/2407.04295","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:56b35c50fd46d5b4b55fc795c110eafad9475bed603c607a47b72a47f2d08d90","observation_id":"e5a471fa-7e7f-4574-9a62-43f4c4fccc1a","resolution":{"observed_at":"2026-08-05T10:32:27.894549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-05T10:32:27.897865Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.897865Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:f6d027895a4b1a64ea566a1d547d4c8b312e04a5219de84699ffb01aa1327457","observation_id":"48dc659b-774e-499a-a224-8e319c01d35d","resolution":{"observed_at":"2026-08-05T10:32:27.897865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.243176Z","title":"Zhang, J","venue":null,"work_id":"07c56460-d829-4834-adb0-7fe7579c8493","year":null},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.901189Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:61a3eca4cf2830d52786e59814f7416ee562e628b33920316b8363e41aef59d6","observation_id":"9b85659e-4ae7-498c-a140-eba3c2c59965","resolution":{"observed_at":"2026-08-05T10:32:28.245833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04782","last_updated":"2023-12-08T01:41:36Z","snapshot_observed_at":"2026-08-06T10:01:22.159507Z","submitted_at":"2023-12-08T01:41:36Z","title":"Make Them Spill the Beans! Coercive Knowledge Extraction from (Production) LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04782","snapshot_observed_at":"2026-08-05T10:32:27.904276Z","title":"Zhang, G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.904276Z"},"links":{"cited_paper":"/paper/2312.04782","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:ed7d9dc8ef4675b82e0577b3a75a5e439a6e7e66580e012fa4b04f3823918559","observation_id":"25028c51-82b1-4d53-b85c-876045172e81","resolution":{"observed_at":"2026-08-05T10:32:27.904276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.231101Z","title":null,"venue":null,"work_id":"8658cef9-668b-4116-bf00-88067ec347b3","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.907289Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:c4fc44c6efd26fd329df012158f7849f28297488abcd4971fb2c31743bbe7720","observation_id":"84df5c80-46bd-412e-8a06-f529be12ed7b","resolution":{"observed_at":"2026-08-05T10:32:28.234225Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.221119Z","title":null,"venue":null,"work_id":"3eafa77a-a395-4ba2-8ba5-daafd7e157cd","year":2025},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.910773Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:3a9817cc8f095cfbc4fb88f768620e6fb7f43e35c2ded02291bef227e594282c","observation_id":"222de5f1-9a39-4bab-9b92-7f320a2780a2","resolution":{"observed_at":"2026-08-05T10:32:28.224395Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.210434Z","title":null,"venue":null,"work_id":"944a7abd-6416-4442-a531-a6eca00db1ee","year":2025},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.914523Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:4a8fe323d8a9cc3d2b30d499c8fa57cb2dcbae655e1cad2894487468a61308ae","observation_id":"b1a15840-c1f2-428c-a104-460d3f61ea3d","resolution":{"observed_at":"2026-08-05T10:32:28.213119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.201408Z","title":null,"venue":null,"work_id":"425a94be-58b0-45c5-bd53-e25b78acff31","year":2024},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.917480Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:9d0703f245e41eaa52481e0c75893d7707020b6a241f034fa20f901a011e368d","observation_id":"f4b89c5c-7351-4dd7-be2f-b6d837437c72","resolution":{"observed_at":"2026-08-05T10:32:28.204275Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.192208Z","title":null,"venue":null,"work_id":"69defddd-79c5-4237-996e-3449de2be2e5","year":null},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.920128Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:8924e0eb9124a9bf81855b41e4c5a1e89c87e75d3808ee66fe0885878f33c879","observation_id":"dea69cce-f81b-44f3-a477-1a5d5094e582","resolution":{"observed_at":"2026-08-05T10:32:28.194976Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T10:32:27.923260Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.923260Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:ab2c4d657c9c12cdcda0404ef6fd4ba4a120b75c9a4431deea0b28bb8313fcc5","observation_id":"042f5ab6-530d-45d7-865a-e325d3ccb9a0","resolution":{"observed_at":"2026-08-05T10:32:27.923260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:32:28.494341Z","title":null,"venue":null,"work_id":"2a7aba34-9784-4a94-bbfd-2db90b239e5e","year":null},"citing_paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T10:32:27.790104Z"},"links":{"citing_paper":"/paper/2509.03985"},"observation_digest":"sha256:b95de2cfe9b30000bb2183e000b46e7e67aa3bb723cfd05690065d59f1c713aa","observation_id":"c02c9b8c-cc67-4429-9fc5-a43ba246c2a7","resolution":{"observed_at":"2026-08-05T10:32:28.497302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03985","last_updated":"2025-09-04T08:12:06Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-05T10:32:26.147875Z","submitted_at":"2025-09-04T08:12:06Z","title":"NeuroBreak: Unveil Internal Jailbreak Mechanisms in Large Language Models"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":56,"verified_exact":2,"verified_fuzzy":19},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 0 inbound Pith citation observations for arXiv:2509.03985."}