{"as_of":"2026-08-07T09:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:91d2d2fc1a89256ac3d528657c57b68e0c7658d164e0c5981729344a4cdeb86b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:41:33.346536Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T07:46:56.508546Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-08-06T21:41:33.346536Z","title":"Stay in character!","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23576","last_updated":"2025-06-30T07:29:07Z","snapshot_observed_at":"2026-08-07T06:18:43.781682Z","submitted_at":"2025-06-30T07:29:07Z","title":"Evaluating Multi-Agent Defences Against Jailbreaking Attacks on Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:41:33.346536Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2506.23576"},"observation_digest":"sha256:6956e666c623054041260fb34bdba300e8ba891398b3929d97c840f46c9badf2","observation_id":"429d95b4-f72c-454b-a70f-8be9adf9e52c","resolution":{"observed_at":"2026-08-06T21:41:33.346536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-08-06T16:28:53.895617Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13474","last_updated":"2025-07-17T18:33:50Z","snapshot_observed_at":"2026-08-06T16:21:22.177023Z","submitted_at":"2025-07-17T18:33:50Z","title":"Paper Summary Attack: Jailbreaking LLMs through LLM Safety Papers","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T16:28:53.895617Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2507.13474"},"observation_digest":"sha256:50971e24a9aa2d4d686cda8d3cbdf3b76705c7c921c0cae127366461339ccf0f","observation_id":"51d00b66-1e49-4927-b73b-35dfe637e7e1","resolution":{"observed_at":"2026-08-06T16:28:53.895617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-08-04T23:09:41.500858Z","title":"How alignment and jailbreak work: Explain llm safety through intermediate hidden states,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.06807","last_updated":"2025-09-08T15:39:17Z","snapshot_observed_at":"2026-08-06T11:18:26.434722Z","submitted_at":"2025-09-08T15:39:17Z","title":"MoGU V2: Toward a Higher Pareto Frontier Between Model Usability and Security","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T23:09:41.500858Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2509.06807"},"observation_digest":"sha256:89044c5aa8461aaf55ee9740b21f70adcfbcc1c113662c8024fcae0d64ac1d22","observation_id":"a6e098f9-c354-479b-b8f2-9964ef0d3085","resolution":{"observed_at":"2026-08-04T23:09:41.500858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":"2406.05644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-07-10T07:46:56.508546Z","title":"Zou, A., Wang, Z., Carlini, N., Nasr, M., Kolter, J","venue":"cs.CL","work_id":"c30392fa-e335-4ae6-8e09-beb5ce8ea29e","year":2024},"citing_paper":{"arxiv_id":"2604.11663","last_updated":"2026-04-13T16:11:38Z","snapshot_observed_at":"2026-07-06T22:59:59.220594Z","submitted_at":"2026-04-13T16:11:38Z","title":"Why Do Large Language Models Generate Harmful Content?","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T15:31:13.545599Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2604.11663"},"observation_digest":"sha256:170cd2a053ba258cd7d4d86fe8c499eb5da35d4e0e4e95b235055853cbaad807","observation_id":"7714dea5-9a52-4358-9262-6a615eea9535","resolution":{"observed_at":"2026-05-11T10:21:04.470748Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":"2406.05644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-07-10T07:46:56.508546Z","title":"Zou, A., Wang, Z., Carlini, N., Nasr, M., Kolter, J","venue":"cs.CL","work_id":"c30392fa-e335-4ae6-8e09-beb5ce8ea29e","year":2024},"citing_paper":{"arxiv_id":"2605.02914","last_updated":"2026-04-08T05:27:33Z","snapshot_observed_at":"2026-08-02T18:20:53.616601Z","submitted_at":"2026-04-08T05:27:33Z","title":"When Safety Geometry Collapses: Fine-Tuning Vulnerabilities in Agentic Guard Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T18:43:12.298529Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2605.02914"},"observation_digest":"sha256:bcee07b51c7e3b764113358bdfff8e80bf1555faa3b2ba8b3aee56b6dc770e76","observation_id":"3eaf97ba-80cc-4432-8313-40a0fbf8663d","resolution":{"observed_at":"2026-05-11T00:05:49.276055Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":"2406.05644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-07-10T07:46:56.508546Z","title":"Zou, A., Wang, Z., Carlini, N., Nasr, M., Kolter, J","venue":"cs.CL","work_id":"c30392fa-e335-4ae6-8e09-beb5ce8ea29e","year":2024},"citing_paper":{"arxiv_id":"2605.12726","last_updated":"2026-07-09T09:24:42Z","snapshot_observed_at":"2026-08-06T13:20:37.791677Z","submitted_at":"2026-05-12T20:30:24Z","title":"Before the Last Token: Diagnosing Final-Token Safety Probe Failures","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-14T21:37:02.439454Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2605.12726"},"observation_digest":"sha256:3c6a615f20c269dbc29501686c46e62fc3b7d086908637e6d8987ccefdf1641b","observation_id":"6df54325-e926-4bbe-8a01-62e1217e5e4d","resolution":{"observed_at":"2026-05-14T21:38:00.112172Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":"2406.05644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-07-10T07:46:56.508546Z","title":"Zou, A., Wang, Z., Carlini, N., Nasr, M., Kolter, J","venue":"cs.CL","work_id":"c30392fa-e335-4ae6-8e09-beb5ce8ea29e","year":2024},"citing_paper":{"arxiv_id":"2606.19755","last_updated":"2026-06-18T03:35:32Z","snapshot_observed_at":"2026-07-06T23:55:01.487552Z","submitted_at":"2026-06-18T03:35:32Z","title":"SafeSpec: Fast and Safe LLM via Dynamic Reflective Sampling","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T17:23:06.382761Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2606.19755"},"observation_digest":"sha256:2027d7091945bd85349bb90f460cca6e9a6f2d50369f7a856ff937c9e59c8927","observation_id":"38a18b8f-01ee-495f-956b-76c41180bbf5","resolution":{"observed_at":"2026-07-04T03:59:33.720230Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":"2406.05644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-07-10T07:46:56.508546Z","title":"Zou, A., Wang, Z., Carlini, N., Nasr, M., Kolter, J","venue":"cs.CL","work_id":"c30392fa-e335-4ae6-8e09-beb5ce8ea29e","year":2024},"citing_paper":{"arxiv_id":"2607.08423","last_updated":"2026-07-17T06:43:02Z","snapshot_observed_at":"2026-08-02T07:53:02.781797Z","submitted_at":"2026-07-09T12:46:00Z","title":"OmniFood-Bench: Evaluating VLMs for Nutrient Reasoning and Personalized Health Advice","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-10T07:41:35.741974Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2607.08423"},"observation_digest":"sha256:755c758ce2705591bd2534f27041c438b543619e0a46b7e0c0d065b9945517b8","observation_id":"3fbb7da7-e5fb-447a-8874-2ff1e1274ff6","resolution":{"observed_at":"2026-07-10T07:46:56.509857Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-08-02T07:53:06.547479Z","title":"How alignment and jailbreak work: Explain llm safety through intermediate hidden states,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08423","last_updated":"2026-07-17T06:43:02Z","snapshot_observed_at":"2026-08-02T07:53:02.781797Z","submitted_at":"2026-07-09T12:46:00Z","title":"OmniFood-Bench: Evaluating VLMs for Nutrient Reasoning and Personalized Health Advice","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T07:53:06.547479Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2607.08423"},"observation_digest":"sha256:5012cec46b6574fea51a2c6ec17cb93dbb3d312d0cacd4f1e5c5a3a8aa252931","observation_id":"be95769d-5559-4498-b31b-3c400c93723e","resolution":{"observed_at":"2026-08-02T07:53:06.547479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-08-01T23:15:30.920135Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15495","last_updated":"2026-07-16T22:54:30Z","snapshot_observed_at":"2026-08-07T08:22:43.917790Z","submitted_at":"2026-07-16T22:54:30Z","title":"Verbalizable Representations Form a Global Workspace in Language Models","version":1},"reference_index":186,"source":"pdf_text","source_observed_at":"2026-08-01T23:15:30.920135Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2607.15495"},"observation_digest":"sha256:26e1c67b2f2e9ebf64afd462ed993b80f809ef5ab63db57abb1b3d2fabe0efa9","observation_id":"bfd23706-d0de-4641-a148-94c13ce1ec17","resolution":{"observed_at":"2026-08-01T23:15:30.920135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.05644/citation-record","integrity":"/paper/2406.05644/integrity","json":"/paper/2406.05644/citation-record.json","paper":"/paper/2406.05644"},"outbound":[],"paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-04T01:38:16.363370Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2406.05644."}