{"as_of":"2026-08-15T05:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:17f5faa8e43920cacf4adcb2f17cbe043a9e8e71322477c4c9c22ca784aef897","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:03:01.160084Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T00:27:29.198098Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":"2402.15911","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-07-03T00:27:29.198098Z","title":"Prp: Propagating universal perturbations to attack large language model guard-rails","venue":null,"work_id":"fce49e9d-e649-4c8d-baa6-64c018f5a4a4","year":2024},"citing_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-12T17:45:10.384900Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-15T02:20:44.368219Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2407.04295"},"observation_digest":"sha256:f981afe4f2704e8b2397c2a4a88b23b446431181b8172d15e0864fef16f61560","observation_id":"ae4733b9-1679-4d0d-9a39-16e50b253d2f","resolution":{"observed_at":"2026-05-15T02:20:44.773775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":"2402.15911","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-07-03T00:27:29.198098Z","title":"Prp: Propagating universal perturbations to attack large language model guard-rails","venue":null,"work_id":"fce49e9d-e649-4c8d-baa6-64c018f5a4a4","year":2024},"citing_paper":{"arxiv_id":"2410.09024","last_updated":"2025-04-18T14:30:31Z","snapshot_observed_at":"2026-08-15T04:06:41.983786Z","submitted_at":"2024-10-11T17:39:22Z","title":"AgentHarm: A Benchmark for Measuring Harmfulness of LLM Agents","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-14T01:35:50.992477Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2410.09024"},"observation_digest":"sha256:4c37ab62cb0563d81ab8603e2cac099f00b83e933bcd071ac462ef76a95450c2","observation_id":"2eda4dab-6848-453a-84ce-1c5af30e8cec","resolution":{"observed_at":"2026-05-14T01:35:51.237222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-08-12T11:03:01.160084Z","title":"Prp: Propagating universal perturbations to attack large lan- guage model guard-rails.arXiv preprint arXiv:2402.15911,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18688","last_updated":"2025-06-14T04:20:06Z","snapshot_observed_at":"2026-08-12T10:56:39.039288Z","submitted_at":"2024-11-27T19:00:10Z","title":"Immune: Improving Safety Against Jailbreaks in Multi-modal LLMs via Inference-Time Alignment","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T11:03:01.160084Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2411.18688"},"observation_digest":"sha256:fd7584a6f21db7ecc9c77f8c2d7916e9e853df9413f47ba12217d23cdcb6f084","observation_id":"6bbfa8a2-5f24-4183-ad8b-9dd88745baac","resolution":{"observed_at":"2026-08-12T11:03:01.160084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-08-11T20:53:37.615066Z","title":"Prp: Propagatinguniversalperturbationstoattacklargelanguagemodel guard-rails","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.05232","last_updated":"2025-07-03T18:06:35Z","snapshot_observed_at":"2026-08-14T13:58:04.180134Z","submitted_at":"2024-12-06T18:02:59Z","title":"LIAR: Leveraging Inference Time Alignment (Best-of-N) to Jailbreak LLMs in Seconds","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T20:53:37.615066Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2412.05232"},"observation_digest":"sha256:0b8dce77eb7d50290a4675f41fc9a9038c12d7455305650d9e8d28beef1cb337","observation_id":"915f8aba-f70c-485a-ab68-f50a5f284d90","resolution":{"observed_at":"2026-08-11T20:53:37.615066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-08-10T00:12:04.983389Z","title":"Prp: Propagating universal perturbations to attack large language model guard-rails","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18280","last_updated":"2025-05-17T04:37:43Z","snapshot_observed_at":"2026-08-13T05:21:46.300369Z","submitted_at":"2025-01-30T11:37:40Z","title":"Jailbreaking LLMs' Safeguard with Universal Magic Words for Text Embedding Models","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T00:12:04.983389Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2501.18280"},"observation_digest":"sha256:167cbf82c9c3777aa684ad74b9bb783a99a05388dfabab3ebc17710a064e262b","observation_id":"17ff1f8b-e15b-43da-9b80-9da31bfc2cb6","resolution":{"observed_at":"2026-08-10T00:12:04.983389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-08-09T19:14:53.691478Z","title":"3, 18 Michael McCloskey and Neal J","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00406","last_updated":"2025-07-08T15:49:01Z","snapshot_observed_at":"2026-08-12T15:51:37.208060Z","submitted_at":"2025-02-01T11:45:44Z","title":"Agents Are All You Need for LLM Unlearning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-09T19:14:53.691478Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2502.00406"},"observation_digest":"sha256:803533258318bd04d915026794e706dd50b5e2c8284b39ea151ddb12409cb68d","observation_id":"2c41d5a4-730b-4c3a-8a68-191552b8341d","resolution":{"observed_at":"2026-08-09T19:14:53.691478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-08-09T12:47:21.714790Z","title":"Prp: Propagating universal perturbations to attack large langu age model guard-rails","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.02260","last_updated":"2026-06-02T17:48:48Z","snapshot_observed_at":"2026-08-12T14:47:41.023865Z","submitted_at":"2025-02-04T12:17:08Z","title":"Position: Adversarial ML for LLMs Is Not Making Any Progress","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-09T12:47:21.714790Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2502.02260"},"observation_digest":"sha256:e96bab6e5d18cce81504f418f9407d0ccbc81d9e212240e7ab280bc5896683e2","observation_id":"fd5542b4-8da6-4dbc-a958-44f704face51","resolution":{"observed_at":"2026-08-09T12:47:21.714790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-08-07T00:15:01.975098Z","title":"Mangaokar, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.14922","last_updated":"2025-06-24T19:55:23Z","snapshot_observed_at":"2026-08-13T20:33:14.014427Z","submitted_at":"2025-06-17T19:08:02Z","title":"FORTRESS: Frontier Risk Evaluation for National Security and Public Safety","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:01.975098Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2506.14922"},"observation_digest":"sha256:28123a812ce927e2d751bd40f3f0f8636002879c7adfc341392853640e28a13f","observation_id":"10498fd5-ae2b-48cf-9c57-cbc237cc3147","resolution":{"observed_at":"2026-08-07T00:15:01.975098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-08-05T20:31:33.306997Z","title":"Prp: Propagating universal perturbations to attack large language model guard-rails","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10404","last_updated":"2025-08-14T07:12:44Z","snapshot_observed_at":"2026-08-14T12:49:41.668100Z","submitted_at":"2025-08-14T07:12:44Z","title":"Layer-Wise Perturbations via Sparse Autoencoders for Adversarial Text Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T20:31:33.306997Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2508.10404"},"observation_digest":"sha256:08d895c0eb53bdf4cb0d9e7c010929aa3444e106d2592664c4095e0e174aad67","observation_id":"c8da5bc0-1678-4e7d-a684-7202620ad8c0","resolution":{"observed_at":"2026-08-05T20:31:33.306997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":"2402.15911","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-07-03T00:27:29.198098Z","title":"Prp: Propagating universal perturbations to attack large language model guard-rails","venue":null,"work_id":"fce49e9d-e649-4c8d-baa6-64c018f5a4a4","year":2024},"citing_paper":{"arxiv_id":"2605.18991","last_updated":"2026-05-20T17:25:38Z","snapshot_observed_at":"2026-08-15T02:56:24.685084Z","submitted_at":"2026-05-18T18:11:17Z","title":"Agent Security is a Systems Problem","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T09:02:59.719090Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2605.18991"},"observation_digest":"sha256:7804375596b407607e2eca539d25f79d76d0e9fa741168fc6906da40a6fa3dbe","observation_id":"5a803722-075c-4ca4-9f3a-14fe95ff78e9","resolution":{"observed_at":"2026-05-20T09:03:09.830565Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":"2402.15911","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-07-03T00:27:29.198098Z","title":"Prp: Propagating universal perturbations to attack large language model guard-rails","venue":null,"work_id":"fce49e9d-e649-4c8d-baa6-64c018f5a4a4","year":2024},"citing_paper":{"arxiv_id":"2605.18991","last_updated":"2026-05-20T17:25:38Z","snapshot_observed_at":"2026-08-15T02:56:24.685084Z","submitted_at":"2026-05-18T18:11:17Z","title":"Agent Security is a Systems Problem","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-21T07:43:14.250188Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2605.18991"},"observation_digest":"sha256:1e7d98c4122443d9ea0e2c848594cb0561af183cdd2e756e0321e3bd73da4f74","observation_id":"7a9a73d9-29d0-4f53-bfb5-d8480f1248f7","resolution":{"observed_at":"2026-05-21T07:44:02.881062Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails","version":1},"cited_work":{"arxiv_id":"2402.15911","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.15911","snapshot_observed_at":"2026-07-03T00:27:29.198098Z","title":"Prp: Propagating universal perturbations to attack large language model guard-rails","venue":null,"work_id":"fce49e9d-e649-4c8d-baa6-64c018f5a4a4","year":2024},"citing_paper":{"arxiv_id":"2606.09388","last_updated":"2026-06-08T12:03:51Z","snapshot_observed_at":"2026-08-13T14:47:40.331413Z","submitted_at":"2026-06-08T12:03:51Z","title":"Distilling Safe LLM Systems via Soft Prompts for On Device Settings","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-27T17:15:51.375580Z"},"links":{"cited_paper":"/paper/2402.15911","citing_paper":"/paper/2606.09388"},"observation_digest":"sha256:f14b17b90a716a839366e0836e02ddbc77b23ef09e90119bd9aed3e7114ed8df","observation_id":"af6594d7-cf8c-4d3f-8284-6f6b4cbe31d1","resolution":{"observed_at":"2026-07-03T00:27:29.199712Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2402.15911/citation-record","integrity":"/paper/2402.15911/integrity","json":"/paper/2402.15911/citation-record.json","paper":"/paper/2402.15911"},"outbound":[],"paper":{"arxiv_id":"2402.15911","last_updated":"2024-02-24T21:27:13Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-13T04:10:49.814777Z","submitted_at":"2024-02-24T21:27:13Z","title":"PRP: Propagating Universal Perturbations to Attack Large Language Model Guard-Rails"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2402.15911."}