{"as_of":"2026-08-17T19:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1bf52b8306e0943602bd9f89ace38f7f7b3cca86b7fa4819456666d78aca0b09","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:19:43.290503Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.13052/citation-record","integrity":"/paper/2504.13052/integrity","json":"/paper/2504.13052/citation-record.json","paper":"/paper/2504.13052"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.143328Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.143328Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:0221094e810813f5833094a90896194e54cc10e36afaf2e3901ffec1f6ce542e","observation_id":"97ca7d1c-0d5e-4c38-b937-a3c5c8653d16","resolution":{"observed_at":"2026-08-16T12:19:43.143328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-16T12:19:43.148647Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.148647Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:2d00deabd59e61ef8c9f4e8b764acd7e0454a5f80a91da64c2cbd8b49b4a58b4","observation_id":"118e1112-7d1c-4038-9cf1-fce9188c2b53","resolution":{"observed_at":"2026-08-16T12:19:43.148647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-16T12:19:43.153378Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.153378Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:bd896c95cf0aaead103d91723a46dd8e31d73e979d5448058670df8c3857c700","observation_id":"811a994f-9aea-4927-95f7-ad8f026b6b9b","resolution":{"observed_at":"2026-08-16T12:19:43.153378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.158269Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.158269Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:1b46b5b2c7b154f544921138e968aebe113af60186858271f7b7136ac7cd958d","observation_id":"32c7c8c7-4524-4028-a740-2539b93b3b0c","resolution":{"observed_at":"2026-08-16T12:19:43.158269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.761856Z","title":null,"venue":null,"work_id":"e6374630-38db-4fae-887d-2b7dd2934d90","year":2021},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.167007Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:ce6661ff6a22d6308b1a702a0bbb1e49cf25de21acd6b4b73067e6ca224f741d","observation_id":"8d880b1e-11fa-4584-9f35-c8120ce55f4a","resolution":{"observed_at":"2026-08-16T12:19:43.765797Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.749361Z","title":"Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah, Jared D","venue":null,"work_id":"2ee91c2f-c5e1-42e5-b391-e2ae76af3fd2","year":2020},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.171410Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:7169c0f4afef667626289775d669475404900afd1c486db6c20e0663edfe0f45","observation_id":"d3b2548c-b64d-47fb-ba9d-5a0edf2cdb43","resolution":{"observed_at":"2026-08-16T12:19:43.753505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-16T12:19:43.175652Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.175652Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:d2abc6051b9da1621972e81848239a564bfa7bced61833c62d300912e917dde9","observation_id":"652e7996-236d-4768-a90b-9f7bc16bca9d","resolution":{"observed_at":"2026-08-16T12:19:43.175652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-16T12:19:43.181415Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.181415Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:914e7f25d8f9db03ccd9e84981d20c81d77c891eaac5afd83df415bdd135733f","observation_id":"3d3a3249-ff8b-473c-a62f-25e760b3eceb","resolution":{"observed_at":"2026-08-16T12:19:43.181415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.735735Z","title":"Christiano, Jan Leike, Tom Brown, Miljan Martic, Shane Legg, and Dario Amodei","venue":null,"work_id":"4a2bbef2-a6c0-4bb2-b170-eb474551de34","year":2017},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.185504Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:fc0986c4810191690a021837120d812f2d7a9e3e47fa2ea1aaa2b253dbd0e4ce","observation_id":"1e87f891-c18e-4205-b13f-2a22924b6ac8","resolution":{"observed_at":"2026-08-16T12:19:43.741468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.720568Z","title":null,"venue":null,"work_id":"3f8ef542-f6e0-43a4-bc55-1ba76e08b8a7","year":2017},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.189543Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:62b55661a304484bcc7ef08fb14d940e66d30133f792aa70847a70014b9db4b9","observation_id":"d6015ac9-89f9-4acb-b4b5-84bc9fe685e2","resolution":{"observed_at":"2026-08-16T12:19:43.726013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14680","last_updated":"2022-10-12T18:01:23Z","snapshot_observed_at":"2026-08-16T17:11:19.673268Z","submitted_at":"2022-03-28T12:26:00Z","title":"Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14680","snapshot_observed_at":"2026-08-16T12:19:43.193692Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.193692Z"},"links":{"cited_paper":"/paper/2203.14680","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:116b08c21b776afa270d64bb55d6e5b6a373deeb755fba1d4eeeda7ca0fce207","observation_id":"d87ae1a4-a71d-4e46-a44c-4e4e780eddf4","resolution":{"observed_at":"2026-08-16T12:19:43.193692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.707995Z","title":null,"venue":null,"work_id":"b4f2c7cd-6bb5-47b0-ac09-4770d9505399","year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.199848Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:23acf96d2c0a0e9f9fcc976947b1a833882bf168873e206a9b268f53803da2cd","observation_id":"9806ca26-e42d-4d14-9dea-65d88ec9637b","resolution":{"observed_at":"2026-08-16T12:19:43.711933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.693364Z","title":null,"venue":null,"work_id":"725cc094-77a9-4809-993f-61b4e51f5c2e","year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.203863Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:8bedf9a255c4f81efb6f89813ea1058961fde6a7b151128b2e296067f73f864d","observation_id":"266546f7-6626-4e6e-9e03-25fdf72376ca","resolution":{"observed_at":"2026-08-16T12:19:43.697932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.677524Z","title":null,"venue":null,"work_id":"cded60c9-3535-44b9-bd7b-a349e8183e6a","year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.207779Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:ff8f73de60509e3238fc25f972ceff53fd9963d50810eaaaf19513012b27d969","observation_id":"d525fef6-adf0-4d78-b47e-90141a4fa4d7","resolution":{"observed_at":"2026-08-16T12:19:43.681676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.664865Z","title":null,"venue":null,"work_id":"c7bbfeac-0994-4dc0-92b2-cf92f135484d","year":1989},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.211677Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:a23a44a31f4a4bced3d733bbc2ea6ab673e10b13defba8a231059bfbd6305102","observation_id":"b194a0e7-825a-42a4-bc14-3bccf7c95fbd","resolution":{"observed_at":"2026-08-16T12:19:43.668986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.651745Z","title":null,"venue":null,"work_id":"e05a2f64-27ee-48cd-8ae1-a7c4d331ac14","year":null},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.215628Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:6e24c5541a4b60820e352c4391663199c5e57b82af9918a5dc8bbf449af49b4a","observation_id":"cd4ef144-6e1c-4893-98e5-78c173712ea7","resolution":{"observed_at":"2026-08-16T12:19:43.656929Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15852","last_updated":"2024-02-28T21:52:19Z","snapshot_observed_at":"2026-08-16T15:12:22.456889Z","submitted_at":"2023-07-29T00:51:26Z","title":"Dimensionless Policies based on the Buckingham $\\pi$ Theorem: Is This a Good Way to Generalize Numerical Results?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15852","snapshot_observed_at":"2026-08-16T12:19:43.219756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.219756Z"},"links":{"cited_paper":"/paper/2307.15852","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:7192a2b8d09368a87129526a4f2f241a54506647403d92cc7bab9455fb46d04d","observation_id":"308f7068-d749-40fe-8af6-a0e05830fabc","resolution":{"observed_at":"2026-08-16T12:19:43.219756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.223772Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.223772Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:0eb4f13780c8edacbd9ba8c2f6c16dfef5b7a5e74d3ceb230f4ec29f2716e425","observation_id":"7e39b708-40ce-4aa9-96c4-7f7bbfb56129","resolution":{"observed_at":"2026-08-16T12:19:43.223772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-08-17T16:15:31.338042Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-16T12:19:43.227849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.227849Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:34cc959ef3051ca53634e2abe8481c912e02a974c42c7f0ca853a36fa10927b9","observation_id":"6cb12c34-8145-4982-9f69-91fa706c6313","resolution":{"observed_at":"2026-08-16T12:19:43.227849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.630215Z","title":null,"venue":null,"work_id":"d9ea3cb5-d20f-484d-8989-3a1e86cc208e","year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.232538Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:5763808091f2df7eb16d370b2b3a0270dcc2df471900ba585079e4f0dec8e97c","observation_id":"dee33961-7857-401f-bb49-9a725cc6d57a","resolution":{"observed_at":"2026-08-16T12:19:43.635163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.617338Z","title":null,"venue":null,"work_id":"54e7d587-46c8-47e2-97b1-6ebe39df24dd","year":1998},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.236323Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:55fbaa64014116c4514bfe83bf6ccf9af95ba3ae3007774fe7d2f6011ef39dee","observation_id":"7bcdf1c7-5f21-4f98-80ae-771f9ac3ef26","resolution":{"observed_at":"2026-08-16T12:19:43.621779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.240112Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.240112Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:c0d73b9d15bd3fd8e07a5cf60ee287df07f2e13d7ebcc266427ad9f196d91e5e","observation_id":"ac4a5a95-5af9-498c-a05e-83a84d76d493","resolution":{"observed_at":"2026-08-16T12:19:43.240112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-16T12:19:43.243830Z","title":"Wainwright, Pamela Mishkin, Chong Zhang, Sandhini Agarwal, Katarina Slama, Alex Ray, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.243830Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:e3d31266ed89429365afd5e8bdc6f3ad31ea09ba5446c7098222e6e3916ee339","observation_id":"a0ec0796-942a-4426-9333-925076d2bd28","resolution":{"observed_at":"2026-08-16T12:19:43.243830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-08-15T19:46:54.909325Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-16T12:19:43.247800Z","title":"Riedl, Nisan Stiennon, Nathan Scales, Aimee Chan, Mark van der Wilk, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.247800Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:b6be68d9efc303b79a633dfed6afc4e780dc860b851fa810cbaa15c3acbc5978","observation_id":"1e1b977f-11de-42e1-ad99-21424737cd7a","resolution":{"observed_at":"2026-08-16T12:19:43.247800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03693","last_updated":"2023-10-05T17:12:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-05T17:12:17Z","title":"Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03693","snapshot_observed_at":"2026-08-16T12:19:43.251671Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.251671Z"},"links":{"cited_paper":"/paper/2310.03693","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:5f98f869a5f8919ef47b572baea9566db0fea326e608e1f0b2aba490c8122d7c","observation_id":"92bad072-0b99-4894-a0fc-03834dc80dde","resolution":{"observed_at":"2026-08-16T12:19:43.251671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09321","last_updated":"2025-02-04T16:04:22Z","snapshot_observed_at":"2026-08-16T13:43:15.198180Z","submitted_at":"2024-06-13T16:59:43Z","title":"JailbreakEval: An Integrated Toolkit for Evaluating Jailbreak Attempts Against Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09321","snapshot_observed_at":"2026-08-16T12:19:43.255707Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.255707Z"},"links":{"cited_paper":"/paper/2406.09321","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:c03fcaee34baae63eba4e0f74a5dcb19241135daa40dc43591738c021ce4a1ea","observation_id":"4a6c8530-3350-42f1-9823-34a7cd62de4b","resolution":{"observed_at":"2026-08-16T12:19:43.255707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.597379Z","title":null,"venue":null,"work_id":"19b94680-a9ad-457f-b118-c3b5838156e1","year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.259769Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:0d501148727a78bf61a49541014506d4de474e0dc930b477c55e1325f03d175b","observation_id":"3375a036-5715-4335-8b84-4de6ba3d4ec9","resolution":{"observed_at":"2026-08-16T12:19:43.601506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.583777Z","title":null,"venue":null,"work_id":"c7b2225a-9831-423a-8c69-f285a6111959","year":null},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.263894Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:ebf3a2083abc48bb574bdf3c5f5695c663a3526c422e899de2c39bfe9109d114","observation_id":"604df649-8fcc-46de-9a5e-abf9a300014c","resolution":{"observed_at":"2026-08-16T12:19:43.588791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.570441Z","title":null,"venue":null,"work_id":"f96a0b70-716e-4adb-8ed4-4bd271c6ee7b","year":2025},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.271630Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:f69262a5f7a8329b01f4de082d4a0ccc394af4b689ff3711e15096c32ae0d40d","observation_id":"2672420b-f5dc-4646-9501-7e3f02d6788e","resolution":{"observed_at":"2026-08-16T12:19:43.574871Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.556152Z","title":null,"venue":null,"work_id":"261c516a-e3dd-43a2-9342-9bd6cc33cfdc","year":2019},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.275223Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:884760c413635d6a9690c4a035bd1dc3c28ed3fa6075e99a1b94892fd1b923b8","observation_id":"ad23a658-881c-4669-861b-e69216d9075b","resolution":{"observed_at":"2026-08-16T12:19:43.561752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-08-15T10:16:52.688429Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02483","snapshot_observed_at":"2026-08-16T12:19:43.278713Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.278713Z"},"links":{"cited_paper":"/paper/2307.02483","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:cffab18d2a1d7f43e4f0a6632ee0b56514ccb9f4dae7f606caaf604e399d88a6","observation_id":"350f2fc8-3cbd-4df7-9d0c-666506826f6b","resolution":{"observed_at":"2026-08-16T12:19:43.278713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.282682Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.282682Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:6ed5a230acde205f0503eea9f789e4e709d607016d54c434ff969d87d444281f","observation_id":"7f9c0d9b-d5ca-4b42-a2cb-82e98b14aead","resolution":{"observed_at":"2026-08-16T12:19:43.282682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06561","last_updated":"2024-12-16T08:43:24Z","snapshot_observed_at":"2026-08-16T14:27:57.381603Z","submitted_at":"2024-01-12T13:15:05Z","title":"Intention Analysis Makes LLMs A Good Jailbreak Defender","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06561","snapshot_observed_at":"2026-08-16T12:19:43.286453Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.286453Z"},"links":{"cited_paper":"/paper/2401.06561","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:278a1489a62ee277721f8b89d7108b9356c0e418031648e75290923ff3a0128a","observation_id":"b45a4906-2582-42b8-955e-5885222aea9a","resolution":{"observed_at":"2026-08-16T12:19:43.286453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2307.15027","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.374870Z","title":null,"venue":null,"work_id":"c77896be-88cb-43c3-8f97-a17051978951","year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.290503Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:87b48091453a58eac98ca99e015b1c1def1b90f0968fc94495d5f060d101058d","observation_id":"e7cae675-c0a7-422b-902b-ceca414e8fef","resolution":{"observed_at":"2026-08-16T12:19:43.381976Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.162770Z","title":"In Proceedings of the 7th linguistic annotation workshop and interoperability with discourse","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.162770Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:e517fce18946d633d02e070387cf8c1064d97b3a25a89d94d2c026ddb8126c77","observation_id":"60888ade-9167-4b87-9409-905624aa94f1","resolution":{"observed_at":"2026-08-16T12:19:43.162770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-16T12:19:43.267743Z","title":"arXiv preprint arXiv:2307.15043 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.267743Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:177096ba51075663c6549f806a81b74565ea11f048107ef4746945e190e122a0","observation_id":"b139c57a-92d3-4950-82f9-dcb1782ef004","resolution":{"observed_at":"2026-08-16T12:19:43.267743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-17T16:18:48.753550Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2504.13052."}