{"as_of":"2026-08-07T19:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:854797e70cb822943dd9eb59c20667dbef0c7d3d0af34eb38297fd5e082a78bc","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T12:44:04.461847Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:40:26.849024Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"cited_work":{"arxiv_id":"2510.02999","doi":"10.48550/arxiv.2510.02999","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.02999","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRRabs/2510.02999(2025).https://doi.org/ 10.48550/ARXIV.2510.02999,https://doi.org/10.48550/arXiv.2510.02999 Title Suppressed Due to Excessive Length 25","venue":"ArXiv.org","work_id":"ee58edc7-6068-428b-bf28-12bf49a0e00c","year":2025},"citing_paper":{"arxiv_id":"2605.10764","last_updated":"2026-06-29T08:36:15Z","snapshot_observed_at":"2026-07-06T23:22:42.512039Z","submitted_at":"2026-05-11T15:59:02Z","title":"Break the Brake, Not the Wheel: Untargeted Jailbreak via Entropy Maximization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T03:37:02.206788Z"},"links":{"cited_paper":"/paper/2510.02999","citing_paper":"/paper/2605.10764"},"observation_digest":"sha256:24f1ec95b45ef0401f8a809670cb3cf5244f17c9aed074ef8bf0c64eb097179b","observation_id":"ab0e3d04-815c-404d-a926-28f32950a061","resolution":{"observed_at":"2026-07-09T01:19:04.946819Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"cited_work":{"arxiv_id":"2510.02999","doi":"10.48550/arxiv.2510.02999","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.02999","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRRabs/2510.02999(2025).https://doi.org/ 10.48550/ARXIV.2510.02999,https://doi.org/10.48550/arXiv.2510.02999 Title Suppressed Due to Excessive Length 25","venue":"ArXiv.org","work_id":"ee58edc7-6068-428b-bf28-12bf49a0e00c","year":2025},"citing_paper":{"arxiv_id":"2605.10764","last_updated":"2026-06-29T08:36:15Z","snapshot_observed_at":"2026-07-06T23:22:42.512039Z","submitted_at":"2026-05-11T15:59:02Z","title":"Break the Brake, Not the Wheel: Untargeted Jailbreak via Entropy Maximization","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T22:36:35.008744Z"},"links":{"cited_paper":"/paper/2510.02999","citing_paper":"/paper/2605.10764"},"observation_digest":"sha256:275d0c16a23c62e37f313f1e1f3a152d983e8691a341b1c04af9255988557ace","observation_id":"4d471524-fb69-49e7-a637-52a4588d4159","resolution":{"observed_at":"2026-07-09T01:19:04.946819Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"cited_work":{"arxiv_id":"2510.02999","doi":"10.48550/arxiv.2510.02999","metadata_source":"arxiv_reference","pith_arxiv_id":"2510.02999","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRRabs/2510.02999(2025).https://doi.org/ 10.48550/ARXIV.2510.02999,https://doi.org/10.48550/arXiv.2510.02999 Title Suppressed Due to Excessive Length 25","venue":"ArXiv.org","work_id":"ee58edc7-6068-428b-bf28-12bf49a0e00c","year":2025},"citing_paper":{"arxiv_id":"2605.24817","last_updated":"2026-05-24T02:06:44Z","snapshot_observed_at":"2026-07-06T23:34:52.129354Z","submitted_at":"2026-05-24T02:06:44Z","title":"RouteScan: A Non-Intrusive Approach to Auditing MoE LLMs Safety via Expert Routing Telemetry","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T00:33:35.235214Z"},"links":{"cited_paper":"/paper/2510.02999","citing_paper":"/paper/2605.24817"},"observation_digest":"sha256:219c3881c31b25a8c4b1c7574c4df548bff109c33583a2729c70068dd290ac90","observation_id":"ca9c06c3-4896-4420-bc99-9c0576a0a024","resolution":{"observed_at":"2026-07-09T01:19:04.946819Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.02999","snapshot_observed_at":"2026-08-01T11:40:26.849024Z","title":"Hakan Inan, Kartikeya Upasani, Jianfeng Chi, Rashi Rungta, Krithika Iyer, Yuning Mao, Michael Tontchev, Qing Hu, Brian Fuller, Davide Testuggine, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-06T19:43:18.323440Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.849024Z"},"links":{"cited_paper":"/paper/2510.02999","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:cf9cacb31b7f75d01274fea2dabffcb8631ab5fc96da10f330c248094ea22fae","observation_id":"e8aaf750-6a18-4fec-9160-935d9589216e","resolution":{"observed_at":"2026-08-01T11:40:26.849024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2510.02999/citation-record","integrity":"/paper/2510.02999/integrity","json":"/paper/2510.02999/citation-record.json","paper":"/paper/2510.02999"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:01.737579Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:01.737579Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:6f75244d3e2573bac4a7f92a7d3499c9be5abb16588b02b1d093d10e9164e142","observation_id":"82f96f9a-b0a9-4f8f-ac2d-7706310b02d7","resolution":{"observed_at":"2026-08-04T12:44:01.737579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:01.801628Z","title":"Detecting language model attacks with perplexity, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:01.801628Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:f37894f5c16e64c24476c459e3c0ddb693582f0e18d03b95d0690111faaaba67","observation_id":"f8c0db2f-5f99-4ce6-aee7-d9bdc022b6e6","resolution":{"observed_at":"2026-08-04T12:44:01.801628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:01.838175Z","title":"Jailbreaking leading safety-aligned llms with simple adaptive attacks, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:01.838175Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:6433e38468390c85542a9ce70e311b04ccac38e68cf2f448c101988938f6bb47","observation_id":"fbf97da5-0632-4a24-b406-ea975802cafa","resolution":{"observed_at":"2026-08-04T12:44:01.838175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:01.853490Z","title":"When llm meets drl: Advancing jailbreaking efficiency via drl-guided search, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:01.853490Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:015d1a027b94baebeffff43107fe4634bc5fc333e08003f2081157208ac1759e","observation_id":"f4e7b09f-f16f-44a9-bf22-7d086c6f9127","resolution":{"observed_at":"2026-08-04T12:44:01.853490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:01.906304Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:01.906304Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:aa7811c2e9dabcdaf5d86d0322325cfe0250803290261d631da510003faeb394","observation_id":"0655558e-3480-4fac-8b8a-c19c5d93c94a","resolution":{"observed_at":"2026-08-04T12:44:01.906304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-04T12:44:01.973418Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:01.973418Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:9db575d6ae1d0240c462dd32028a95f0820b533fd2ea8febadb088edba1f49e5","observation_id":"65e9bb05-6045-47f1-947a-ed2c986149ff","resolution":{"observed_at":"2026-08-04T12:44:01.973418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:02.127701Z","title":"COLD -attack: Jailbreaking LLM s with stealthiness and controllability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.127701Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:4100a8f7eb010117a5dbafcda793b9469b5bbb93eee4142bc4319af76c31877d","observation_id":"f85f29fa-0e5a-4a00-9619-75833c22f9b9","resolution":{"observed_at":"2026-08-04T12:44:02.127701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:02.271719Z","title":"Dualbreach: Efficient dual-jailbreaking via target-driven initialization and multi-target optimization, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.271719Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:1cc42287d23cdaee9c0e451b4c5e2f24ca9a1e42a8148ac448d14db66d30d5ab","observation_id":"a5e43586-68ea-4a67-8ec3-00cd0cc12845","resolution":{"observed_at":"2026-08-04T12:44:02.271719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:02.387598Z","title":"Baseline defenses for adversarial attacks against aligned language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.387598Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:0325084066db35525d2cdad10c5e575a00edecd500ab713c07137f8cf953026c","observation_id":"3f93b502-44bc-4e6f-83d2-814a79c7a246","resolution":{"observed_at":"2026-08-04T12:44:02.387598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:02.442919Z","title":"Improved techniques for optimization-based jailbreaking on large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.442919Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:8aa535766f6fe917a6b051ebe902cfd691a595a70873e0161dfc90c55b3b90de","observation_id":"fff08df8-39aa-41d5-b004-62c15b0ab9fb","resolution":{"observed_at":"2026-08-04T12:44:02.442919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-04T12:44:02.493204Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.493204Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:91163007b3aa7b0d94fa1b674547e5ef932984ff1a78c47090f62c5c1d9715a4","observation_id":"8bfc140f-61b2-4c86-86fb-b6828864a443","resolution":{"observed_at":"2026-08-04T12:44:02.493204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:02.560937Z","title":"Amplegcg: Learning a universal and transferable generative model of adversarial suffixes for jailbreaking both open and closed llms, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.560937Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:7d939b6e2450824fb4143007c074e52c64b883654de0bf2b380f8993a00dba2d","observation_id":"7dba98d0-cf5b-4e8a-99c1-a17eb67de622","resolution":{"observed_at":"2026-08-04T12:44:02.560937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:02.617654Z","title":"Advancing adversarial suffix transfer learning on aligned large language models, 2024 a","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.617654Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:eb66ee20976526a1933ae3bfe0efe40e94aecf47f0a25d21159cac9069172242","observation_id":"58e52490-cba5-4881-a061-cd720e76e114","resolution":{"observed_at":"2026-08-04T12:44:02.617654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:02.722697Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.722697Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:a23b6caca3e61a4414a0bc72c08c80cad8dd59b80dcc461b3a32600a439850ec","observation_id":"44b3c29d-f3e4-46b4-8285-6587885d555d","resolution":{"observed_at":"2026-08-04T12:44:02.722697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:02.854141Z","title":"Harmbench: a standardized evaluation framework for automated red teaming and robust refusal","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.854141Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:cbf169ebd4f8d026abef26db4ed29afd5ac91b69f09f992ff81b39c924d35488","observation_id":"3cd4317f-86a4-4275-8337-adf3c5de1c7a","resolution":{"observed_at":"2026-08-04T12:44:02.854141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:02.945466Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:02.945466Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:42808d23fb2ee01ea843e0ef6d35f0bd479e0882fbc882b12c36e6243860b015","observation_id":"d5e3f272-3013-4265-819e-714de8ba0ef3","resolution":{"observed_at":"2026-08-04T12:44:02.945466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.057308Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.057308Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:b1e79dcf90af4ebdd3b9d46c9bca2a6fdcd67253eac9f1446d236e4bbebe5cd3","observation_id":"99627969-14ce-4bd0-b05e-fe0ea133414e","resolution":{"observed_at":"2026-08-04T12:44:03.057308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.124554Z","title":"do anything now","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.124554Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:4a347bc33a37f7ebd44a8f304cdd222930f3317a432775c015424c97b2ca4a4c","observation_id":"32d837dd-7eaa-4fe7-8d42-732477ff0ded","resolution":{"observed_at":"2026-08-04T12:44:03.124554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.210753Z","title":"Dynamic target attack, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.210753Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:8563f60b12cc00d37e15c4023ce731957f3d8773da8762dc396298a2df918441","observation_id":"7806188e-7aba-43ba-b7d4-a4f9f494df4e","resolution":{"observed_at":"2026-08-04T12:44:03.210753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.321275Z","title":"Qwen2 technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.321275Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:1868291f24186e1e7ee1f79590ce7e39ce8ff55aec4ff2324db2d9a6271a900e","observation_id":"b17adb40-a580-4eb9-9260-f52588f8032d","resolution":{"observed_at":"2026-08-04T12:44:03.321275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.446300Z","title":"Gptfuzzer: Red teaming large language models with auto-generated jailbreak prompts, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.446300Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:ec5d75d503635bcd1bfd16fbc530aec1b864872e16dfa35a4e8408b572ff7cf4","observation_id":"619c801a-228a-4d86-9dfc-d5b11d3d7384","resolution":{"observed_at":"2026-08-04T12:44:03.446300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.545057Z","title":"How johnny can persuade LLM s to jailbreak them: Rethinking persuasion to challenge AI safety by humanizing LLM s","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.545057Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:c60b3e524eac10ac11366ee851e103d8f5399b87d5166533ea669e32e5a49111","observation_id":"92389e98-7191-44e0-a0a7-55c69ca94434","resolution":{"observed_at":"2026-08-04T12:44:03.545057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.688438Z","title":"A survey of large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.688438Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:831d20b52d454b6a4b7da0eb7ef0af8c2d3f4b77a2af117022d37d629a49eecb","observation_id":"a48dec15-8ace-45e8-854b-6c682d6fe931","resolution":{"observed_at":"2026-08-04T12:44:03.688438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.750088Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.750088Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:2c46f49a5419fc79a9b8631372a2aeea44577ba524c793969ed58384f10cdb68","observation_id":"f4366f98-df0b-4921-9643-28e5a42d7dde","resolution":{"observed_at":"2026-08-04T12:44:03.750088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.877815Z","title":"Don't say no: Jailbreaking llm by suppressing refusal, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.877815Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:ae62f41486ef013db8d8c32d583b337f4968da084f0a26b9e4f3b392a25c921a","observation_id":"f3904a3b-a2ad-48a4-8344-8b8da8182906","resolution":{"observed_at":"2026-08-04T12:44:03.877815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:03.993700Z","title":"Advprefix: An objective for nuanced llm jailbreaks, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:03.993700Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:8ffce36b09bc868f0744ee93def4e6ef877015e78ef1173105ec489cb124f545","observation_id":"cf7c6c90-be23-4f6a-ac7c-75d7edf1e75e","resolution":{"observed_at":"2026-08-04T12:44:03.993700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:04.106273Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:04.106273Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:8a7ec929fe0568f804de73941b0a83fd66c5a2dcca4cde6ec17bf78dad1b488b","observation_id":"333e0d5b-f6d2-40cd-b99a-810623c48468","resolution":{"observed_at":"2026-08-04T12:44:04.106273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:04.216844Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:04.216844Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:1415ea534468bd2d9deaa5bb8fa9b85e3e83f1593366d7f03e2c4106f493008e","observation_id":"dcd6837f-5457-4384-a74a-a6b412d7e5da","resolution":{"observed_at":"2026-08-04T12:44:04.216844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:04.364109Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:04.364109Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:5b729b8c469da81ab17f10f2e421c84bf3d65f40614aea606685a204440417e3","observation_id":"35a50faf-5cfd-4624-b20b-e546bc9580f5","resolution":{"observed_at":"2026-08-04T12:44:04.364109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T12:44:04.461847Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-04T12:44:04.461847Z"},"links":{"citing_paper":"/paper/2510.02999"},"observation_digest":"sha256:6a81081434019a3d509d6fdab27b2c428e2ed41640eeac31a9106c2efb591550","observation_id":"846fbc99-492c-400e-a1ed-32a4121e9599","resolution":{"observed_at":"2026-08-04T12:44:04.461847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","latest_version":5,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-04T12:43:58.934744Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 4 inbound Pith citation observations for arXiv:2510.02999."}