{"as_of":"2026-08-08T21:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e7b519492d37f37a88e20d751fa13ac7b4b5b1b83ac407e7398084d8c389f3de","coverage":[{"denominator":17,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T13:45:27.971234Z","state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.25533/citation-record","integrity":"/paper/2509.25533/integrity","json":"/paper/2509.25533/citation-record.json","paper":"/paper/2509.25533"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T13:45:27.971234Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:27.971234Z"},"links":{"citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:916231d7361330250d22e6513a433fcf41688e570ca5fa7720363b388d58c927","observation_id":"0288cf69-3b9f-47a9-988f-623adeb6abbc","resolution":{"observed_at":"2026-08-04T13:45:27.971234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11751","last_updated":"2023-10-14T12:56:13Z","snapshot_observed_at":"2026-08-02T21:47:41.540245Z","submitted_at":"2023-09-21T03:24:30Z","title":"How Robust is Google's Bard to Adversarial Image Attacks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11751","snapshot_observed_at":"2026-08-04T13:45:26.355350Z","title":"Yinpeng Dong, Huanran Chen, Jiawei Chen, Zhengwei Fang, Xiao Yang, Yichi Zhang, Yu Tian, Hang Su, and Jun Zhu","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:26.355350Z"},"links":{"cited_paper":"/paper/2309.11751","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:4af25e7c0d2b75e0a5e5b13a05e8bd6c6994ca0228e42f44e7dd67110b3d235b","observation_id":"b9798a55-6502-4a83-9d66-1fb0777b9aad","resolution":{"observed_at":"2026-08-04T13:45:26.355350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05528","last_updated":"2025-05-29T23:50:01Z","snapshot_observed_at":"2026-08-07T15:48:50.117496Z","submitted_at":"2025-05-08T11:59:13Z","title":"X-Transfer Attacks: Towards Super Transferable Adversarial Attacks on CLIP","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.05528","snapshot_observed_at":"2026-08-04T13:45:26.695560Z","title":"Kai Konen, Sophie Jentzsch, Diaoul´e Diallo, Peer Sch¨utt, Oliver Bensch, Roxanne El Baff, Dominik Opitz, and Tobias Hecking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:26.695560Z"},"links":{"cited_paper":"/paper/2505.05528","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:0dcf69ccc644ac0ec53d59882d981d1ca6b390df601fad69b3cb37f3a0bc5d4f","observation_id":"aa488af9-c9f8-4af5-b05b-c8f323acbc04","resolution":{"observed_at":"2026-08-04T13:45:26.695560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-04T13:45:26.820422Z","title":"Jailbreaking chatgpt via prompt engineering: An empirical study.arXiv preprint arXiv:2305.13860,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:26.820422Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:db41ec5bb6a6dfbeda36023285796078a56af6620f7d9a20172c7ff48b1c7d0f","observation_id":"55cac5bf-0221-47e5-8ed7-65393e148cbc","resolution":{"observed_at":"2026-08-04T13:45:26.820422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-07T14:28:06.805424Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-04T13:45:26.933234Z","title":"Steering llama 2 via contrastive activation addition.arXiv preprint arXiv:2312.06681,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:26.933234Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:8ef971dcd5f90f8ffa925094bc15fde04b24303b2b721787dab5559078ce0238","observation_id":"b06be588-7243-45e2-a00d-d19b24ded7b8","resolution":{"observed_at":"2026-08-04T13:45:26.933234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13213","last_updated":"2023-08-16T22:38:55Z","snapshot_observed_at":"2026-07-06T15:45:47.517122Z","submitted_at":"2023-06-22T22:13:03Z","title":"Visual Adversarial Examples Jailbreak Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13213","snapshot_observed_at":"2026-08-04T13:45:27.025943Z","title":"Visual adversarial examples jailbreak aligned large language models.arXiv preprint arXiv:2306.13213,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:27.025943Z"},"links":{"cited_paper":"/paper/2306.13213","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:89a167ce274f6df06b8795dbee60b7ecb244db967552e5a70519f4dc9d62d9f2","observation_id":"9a351771-dc91-40a1-969e-0b6c8e39baf7","resolution":{"observed_at":"2026-08-04T13:45:27.025943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15211","last_updated":"2024-12-16T01:20:42Z","snapshot_observed_at":"2026-08-06T03:32:44.618631Z","submitted_at":"2024-07-21T16:27:24Z","title":"Failures to Find Transferable Image Jailbreaks Between Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15211","snapshot_observed_at":"2026-08-04T13:45:27.114819Z","title":"Failures to find transferable image jailbreaks between vision-language models.arXiv preprint arXiv:2407.15211,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:27.114819Z"},"links":{"cited_paper":"/paper/2407.15211","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:e4372fdaeb70d89b3e53136e8222e6e5eace92bc333f6b272737c034d570efe5","observation_id":"aef1dfde-7d44-4d8d-a5e6-2aa53e5b74fe","resolution":{"observed_at":"2026-08-04T13:45:27.114819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.14539","last_updated":"2023-10-10T22:17:17Z","snapshot_observed_at":"2026-07-06T15:59:03.095461Z","submitted_at":"2023-07-26T23:11:15Z","title":"Jailbreak in pieces: Compositional Adversarial Attacks on Multi-Modal Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.14539","snapshot_observed_at":"2026-08-04T13:45:27.193722Z","title":"Jailbreak in pieces: Compositional adversarial attacks on multi-modal language models.arXiv preprint arXiv:2307.14539,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:27.193722Z"},"links":{"cited_paper":"/paper/2307.14539","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:73041b56ef701bf54fe7f66bdbcb3bac9310814e29fbfdaaf3ace36682e85a1d","observation_id":"54bd8f24-2f21-4381-870a-fa1e1b82fc8b","resolution":{"observed_at":"2026-08-04T13:45:27.193722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-04T13:45:27.329648Z","title":"Llama 2: Open founda- tion and fine-tuned chat models.arXiv preprint arXiv:2307.09288,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:27.329648Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:3c43e19843879e56d86eaf15e746a25c9764b70b4e577841b605b2b24fcf9a1c","observation_id":"ef1ac527-737b-4822-910a-5247718a6f87","resolution":{"observed_at":"2026-08-04T13:45:27.329648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-04T13:45:27.475815Z","title":"Activation addition: Steering language models without optimization.arXiv preprint arXiv:2308.10248,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:27.475815Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:975750c4fc65eb6194cd6e9e76cdf0dfd21426c3209f8cf33e929b5fa390cdee","observation_id":"ad59e0bd-557e-4d32-8ad1-01bf5ef03063","resolution":{"observed_at":"2026-08-04T13:45:27.475815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17148","last_updated":"2025-03-03T21:15:30Z","snapshot_observed_at":"2026-08-07T21:53:39.823463Z","submitted_at":"2025-01-28T18:51:24Z","title":"AxBench: Steering LLMs? Even Simple Baselines Outperform Sparse Autoencoders","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17148","snapshot_observed_at":"2026-08-04T13:45:27.597133Z","title":"Axbench: Steering llms? even simple baselines outper- form sparse autoencoders.arXiv preprint arXiv:2501.17148,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:27.597133Z"},"links":{"cited_paper":"/paper/2501.17148","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:d20a9d060f0db1916f6dab889b00678684dee57b169a8541a5b653b04fdae203","observation_id":"fef9a84f-9bd2-402d-979e-78f556efb848","resolution":{"observed_at":"2026-08-04T13:45:27.597133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16934","last_updated":"2023-10-29T12:32:19Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T13:49:44Z","title":"On Evaluating Adversarial Robustness of Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16934","snapshot_observed_at":"2026-08-04T13:45:27.722293Z","title":"On evaluating adversarial robustness of large vision-language models.arXiv preprint arXiv:2305.16934,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:27.722293Z"},"links":{"cited_paper":"/paper/2305.16934","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:2907bd1c394761fa9ab0f1702f4c1e8a6debb517d4d381ed17dbdf6240a93c59","observation_id":"fc3e027f-41fb-48fd-8285-5f1fd1a19a74","resolution":{"observed_at":"2026-08-04T13:45:27.722293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-04T13:45:27.852811Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:27.852811Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:51d496c22cf2fadc26ea5dda4b91101214a78bfb553cbccf632f3ff7dd003e10","observation_id":"698190be-f818-430b-bb02-7e330f05392d","resolution":{"observed_at":"2026-08-04T13:45:27.852811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14071","last_updated":"2025-05-20T08:23:08Z","snapshot_observed_at":"2026-08-08T01:07:30.794755Z","submitted_at":"2025-05-20T08:23:08Z","title":"Textual Steering Vectors Can Improve Visual Understanding in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14071","snapshot_observed_at":"2026-08-04T13:45:26.425121Z","title":"Textual steering vectors can improve visual understanding in multi- modal large language models.arXiv preprint arXiv:2505.14071,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:26.425121Z"},"links":{"cited_paper":"/paper/2505.14071","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:20260a683f35f1d0372f208580a0ecf6132218eddaca794f07deb4c4a75ef710","observation_id":"2b2fd7ac-43cd-4335-9b36-25aaee936410","resolution":{"observed_at":"2026-08-04T13:45:26.425121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05764","last_updated":"2025-01-10T07:41:48Z","snapshot_observed_at":"2026-08-07T00:46:17.624608Z","submitted_at":"2025-01-10T07:41:48Z","title":"Controlling Large Language Models Through Concept Activation Vectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05764","snapshot_observed_at":"2026-08-04T13:45:26.189146Z","title":"Cao et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:26.189146Z"},"links":{"cited_paper":"/paper/2501.05764","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:2894cfbf119de82ae6f6b78225dc7abe3c58ceef93eff78cab61550a0a9f3f17","observation_id":"ebef0b59-8eb2-44e1-8a69-0e328e139d75","resolution":{"observed_at":"2026-08-04T13:45:26.189146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00236","last_updated":"2024-09-17T19:56:09Z","snapshot_observed_at":"2026-08-06T06:17:45.496933Z","submitted_at":"2023-09-01T03:53:40Z","title":"Image Hijacks: Adversarial Images can Control Generative Models at Runtime","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00236","snapshot_observed_at":"2026-08-04T13:45:26.101151Z","title":"Image hijacks: Adversarial images can control generative models at runtime.arXiv preprint arXiv:2309.00236,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:26.101151Z"},"links":{"cited_paper":"/paper/2309.00236","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:8ef441ffdf38832ff949451712d0529b30cf260de859a8a8f94e145214643a79","observation_id":"c82158bb-6354-4108-8dac-4d49dca84707","resolution":{"observed_at":"2026-08-04T13:45:26.101151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-04T13:45:26.549161Z","title":"Measuring massive multitask language understanding.arXiv preprint arXiv:2009.03300,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T13:45:26.549161Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2509.25533"},"observation_digest":"sha256:0cc5f9fb233405feaf37f8452cad6376d379efd749685255dc05aa76049b7b9c","observation_id":"1f4b8a14-b70f-41ac-8c58-79ba983a53fc","resolution":{"observed_at":"2026-08-04T13:45:26.549161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.25533","last_updated":"2026-07-06T05:00:34Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T23:26:32.833872Z","submitted_at":"2025-09-29T21:43:18Z","title":"VISOR++: Universal Visual Inputs based Steering for Large Vision Language Models"},"reference_resolution":{"displayed":17,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":17},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 17 of 17 outbound references and 0 inbound Pith citation observations for arXiv:2509.25533."}