{"as_of":"2026-08-09T10:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3941d7345ff4a3c5a0dbef22c1c6538209cbf028f756f346fe44b9ef73d35361","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:08:02.283463Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-07T23:08:02.283463Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.09674","last_updated":"2025-05-27T08:40:42Z","snapshot_observed_at":"2026-08-09T02:24:15.276351Z","submitted_at":"2025-02-13T06:39:22Z","title":"The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T23:08:02.283463Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2502.09674"},"observation_digest":"sha256:94c73c0be38def49ea30335b9d9550df415ac1f98f63fb651d8618fdefa30f39","observation_id":"d041aa4a-cf62-4cd8-a29d-8289e8798809","resolution":{"observed_at":"2026-08-07T23:08:02.283463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-07T14:13:50.813253Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19690","last_updated":"2025-05-26T08:49:19Z","snapshot_observed_at":"2026-08-08T11:27:57.969115Z","submitted_at":"2025-05-26T08:49:19Z","title":"Beyond Safe Answers: A Benchmark for Evaluating True Risk Awareness in Large Reasoning Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:50.813253Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2505.19690"},"observation_digest":"sha256:f6ab8199a8cd50289c2d8460ff651b985646d53923c80c3cd16bda05752985d0","observation_id":"01b9a4ff-b677-440c-aa06-5bcd0b721490","resolution":{"observed_at":"2026-08-07T14:13:50.813253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-07T14:15:16.955465Z","title":"HiddenDetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23793","last_updated":"2025-05-26T08:39:14Z","snapshot_observed_at":"2026-08-08T01:18:19.713600Z","submitted_at":"2025-05-26T08:39:14Z","title":"USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:16.955465Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2505.23793"},"observation_digest":"sha256:aac857f5ab0c8640bd80dcbe45332977030b4fddb4ac38f61b1107637a11532f","observation_id":"94b3aef8-1d9f-4329-9fb6-cde640ea49e5","resolution":{"observed_at":"2026-08-07T14:15:16.955465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-06T22:04:00.311613Z","title":"Jing, P., Cui, K., Guan, W., Nie, L., and Su, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22769","last_updated":"2025-06-28T06:13:13Z","snapshot_observed_at":"2026-08-06T21:55:50.977658Z","submitted_at":"2025-06-28T06:13:13Z","title":"Learning Efficient Robotic Garment Manipulation with Standardization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T22:04:00.311613Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2506.22769"},"observation_digest":"sha256:b49e8876c65b3396c05f7610a426b7301f9f60c95c1414b33013efda58c17b09","observation_id":"229bef39-207a-4fa2-a909-ede030294c61","resolution":{"observed_at":"2026-08-06T22:04:00.311613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T22:21:02.791999Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hid- den states.arXiv preprint arXiv:2502.14744,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09206","last_updated":"2025-08-10T00:55:54Z","snapshot_observed_at":"2026-08-09T01:17:03.252350Z","submitted_at":"2025-08-10T00:55:54Z","title":"The First Differentiable Transfer-Based Algorithm for Discrete MicroLED Repair","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:02.791999Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2508.09206"},"observation_digest":"sha256:0a9513003b2202c1e08a7b3e2fa68b86ba6c13de1e5277ef70fcd02f6e3ba5d7","observation_id":"e86577b5-cf63-4796-987f-4b919618607c","resolution":{"observed_at":"2026-08-05T22:21:02.791999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T11:40:42.538039Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02324","last_updated":"2025-09-02T13:50:45Z","snapshot_observed_at":"2026-08-08T12:07:04.258402Z","submitted_at":"2025-09-02T13:50:45Z","title":"Language-Guided Long Horizon Manipulation with LLM-based Planning and Visual Perception","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:40:42.538039Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2509.02324"},"observation_digest":"sha256:92e488c23ce81ffd7ac2e8d42f23f9e324328e300d30e33b24123789f6738860","observation_id":"7695229e-18a4-4341-b165-aed5a3105201","resolution":{"observed_at":"2026-08-05T11:40:42.538039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2511.17408","last_updated":"2026-04-19T21:58:15Z","snapshot_observed_at":"2026-08-06T11:23:25.216358Z","submitted_at":"2025-11-21T17:08:48Z","title":"The Impact of Off-Policy Training Data on Probe Generalisation","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-17T20:26:37.914522Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2511.17408"},"observation_digest":"sha256:bb77ac4253bae35e54eaad61aa2f4142a5820c295f4fe0e24ab2986013ae3e04","observation_id":"ca1cfab4-bcff-43a4-87ba-f32f77a1ec62","resolution":{"observed_at":"2026-05-17T20:30:11.638926Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-02T17:39:42.343655Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states.arXiv preprint arXiv:2502.14744, 3(5),","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.23171","last_updated":"2026-07-29T15:06:33Z","snapshot_observed_at":"2026-08-08T17:14:23.529795Z","submitted_at":"2026-03-24T13:13:23Z","title":"Adaptively Robust LLM Monitoring via Activation Watermarking","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T17:39:42.343655Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2603.23171"},"observation_digest":"sha256:f524db8815cc30bd7d490d91d0ddc3a53a820d9eb28f82f842d2823ed0104f65","observation_id":"2e4e9bf4-0386-432b-8f8c-e4ab437f8c22","resolution":{"observed_at":"2026-08-02T17:39:42.343655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2604.06247","last_updated":"2026-04-06T16:29:05Z","snapshot_observed_at":"2026-07-06T22:54:48.916799Z","submitted_at":"2026-04-06T16:29:05Z","title":"SALLIE: Safeguarding Against Latent Language & Image Exploits","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T19:04:46.426969Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2604.06247"},"observation_digest":"sha256:cc54853ea99eee2e6434be645ec086a3183dcdaf046caefdb8ac7ad37aee63ef","observation_id":"50728afd-4e83-48e5-bd82-072f1a15b810","resolution":{"observed_at":"2026-05-10T23:30:51.149721Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2605.03095","last_updated":"2026-05-04T19:17:50Z","snapshot_observed_at":"2026-07-06T23:16:05.372336Z","submitted_at":"2026-05-04T19:17:50Z","title":"Revisiting JBShield: Breaking and Rebuilding Representation-Level Jailbreak Defenses","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T02:16:49.785596Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2605.03095"},"observation_digest":"sha256:7c5592546a6d857d748f302ead89a1215115a3513cd5100c8f9a1008dfc5814a","observation_id":"36de01fb-8a2a-4e07-9ff4-c79d16720069","resolution":{"observed_at":"2026-05-12T10:46:31.207957Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2605.09391","last_updated":"2026-05-15T12:37:57Z","snapshot_observed_at":"2026-07-06T23:21:30.897592Z","submitted_at":"2026-05-10T07:38:34Z","title":"Do Linear Probes Generalize Better in Persona Coordinates?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-12T04:47:47.214726Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2605.09391"},"observation_digest":"sha256:a0401d2cb134843078cccfff3262728c0345796abd442ab5858a727cf91c427a","observation_id":"a7b36e3c-27d4-4ff6-9aa8-3827602b0d25","resolution":{"observed_at":"2026-05-12T04:51:22.869020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2605.09391","last_updated":"2026-05-15T12:37:57Z","snapshot_observed_at":"2026-07-06T23:21:30.897592Z","submitted_at":"2026-05-10T07:38:34Z","title":"Do Linear Probes Generalize Better in Persona Coordinates?","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-19T17:06:22.481341Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2605.09391"},"observation_digest":"sha256:1cc5fbeb76a40127919fdebda0568d76bd610691ac38940c2d49bf721dad3a55","observation_id":"6b828383-b64b-4f1c-995f-7f81925d40d4","resolution":{"observed_at":"2026-05-19T17:07:40.487059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2606.07335","last_updated":"2026-06-05T14:49:26Z","snapshot_observed_at":"2026-07-06T23:47:00.425715Z","submitted_at":"2026-06-05T14:49:26Z","title":"Defending Jailbreak Attacks on Large Language Models via Manifold Trajectory Kinetics","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T21:55:48.561400Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2606.07335"},"observation_digest":"sha256:ae3e5a20f870a092c3e09b75292a13ea5dac4a2595ccbcb9fb5721f9d99ed9da","observation_id":"a9da2504-4fff-4002-8acf-62ae90cc06e9","resolution":{"observed_at":"2026-07-02T17:37:14.918790Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-02T06:30:55.207937Z","title":"Jiang, X","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14147","last_updated":"2026-07-14T09:30:34Z","snapshot_observed_at":"2026-08-04T23:11:22.577320Z","submitted_at":"2026-07-14T09:30:34Z","title":"Breaking Refusal in the First Half: A Mechanistic Study of the Prefill Jailbreak","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T06:30:55.207937Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2607.14147"},"observation_digest":"sha256:d676f084092ec93c320ad0a67d87557768cf978937a23d4634f78aacd28cbde2","observation_id":"be50c1f4-ba70-4939-be24-6620ae2bb353","resolution":{"observed_at":"2026-08-02T06:30:55.207937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-01T08:23:30.045950Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21151","last_updated":"2026-07-26T23:23:12Z","snapshot_observed_at":"2026-08-06T16:53:45.184525Z","submitted_at":"2026-07-23T10:35:38Z","title":"V-DEAL: Diagnosing Video Safety De-Calibration as an Understanding-Refusal Coupling Failure","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T08:23:30.045950Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2607.21151"},"observation_digest":"sha256:a4a396c3008295286dc964256955bd7a04a69ca39e8f2a5a187b5ccc3aeab78d","observation_id":"5b3c30c2-be6d-4e5c-80de-9472927ce71b","resolution":{"observed_at":"2026-08-01T08:23:30.045950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-07T21:24:15.051214Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05909","last_updated":"2026-08-06T11:39:08Z","snapshot_observed_at":"2026-08-09T10:12:28.166264Z","submitted_at":"2026-08-06T11:39:08Z","title":"MMAligner: Safeguarding Multimodal Large Language Models through Representation Calibration","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T21:24:15.051214Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2608.05909"},"observation_digest":"sha256:997e9a085de283fc0e7be0692326d5c71934a8f0ffe1c17bb9556a191c195ea5","observation_id":"0e77d1f4-25a7-4ee5-865a-c23ebb2261b2","resolution":{"observed_at":"2026-08-07T21:24:15.051214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.14744/citation-record","integrity":"/paper/2502.14744/integrity","json":"/paper/2502.14744/citation-record.json","paper":"/paper/2502.14744"},"outbound":[],"paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2502.14744."}