{"as_of":"2026-08-08T13:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b4ce86359713ec86b534c613746eba616f2671081a6dbbcfdbe80c0c39e17e0a","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:35:56.832563Z","state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:58:51.899166Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T12:56:14.862810Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-08-06T20:58:51.899166Z","title":"Adversarial attacks against closed-source mllms via fea- ture optimal alignment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.01367","last_updated":"2025-08-13T01:55:06Z","snapshot_observed_at":"2026-08-07T21:18:32.544911Z","submitted_at":"2025-07-02T05:10:16Z","title":"3D Gaussian Splatting Driven Multi-View Robust Physical Adversarial Camouflage Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:58:51.899166Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2507.01367"},"observation_digest":"sha256:5c20dce89561360fc78a2180c5d36ab7aaee5a6dd6caf377051afb42a1f72ebc","observation_id":"a035745a-d293-41b7-8b98-5a9cef997ecb","resolution":{"observed_at":"2026-08-06T20:58:51.899166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-08-05T16:15:27.911200Z","title":"Adversarial Attacks Against Closed-Source MLLMs via Fea- ture Optimal Alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.18805","last_updated":"2025-08-26T08:40:22Z","snapshot_observed_at":"2026-08-08T01:12:52.353250Z","submitted_at":"2025-08-26T08:40:22Z","title":"Hidden Tail: Adversarial Image Causing Stealthy Resource Consumption in Vision-Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T16:15:27.911200Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2508.18805"},"observation_digest":"sha256:d7f6fd3dd8d387eb43bc0ee60473e801ca2e5a65b5851f59220dfcae9600334e","observation_id":"52dcbe22-e334-4464-890f-9786224efb40","resolution":{"observed_at":"2026-08-05T16:15:27.911200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-08-03T07:47:37.534486Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment.arXiv preprint arXiv:2505.21494,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.19210","last_updated":"2026-06-09T16:01:52Z","snapshot_observed_at":"2026-08-06T16:38:35.610168Z","submitted_at":"2026-01-27T05:24:45Z","title":"Contrastive Spectral Rectification: Test-Time Defense towards Zero-shot Adversarial Robustness of CLIP","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T07:47:37.534486Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2601.19210"},"observation_digest":"sha256:d4c24d3a265d536551a2eff0d63c77a8bb7277add4c98ed553028dea7eb09028","observation_id":"49bd0555-2734-4236-a374-51874690cb3c","resolution":{"observed_at":"2026-08-03T07:47:37.534486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2601.23179","last_updated":"2026-04-20T06:15:25Z","snapshot_observed_at":"2026-08-02T15:37:11.433010Z","submitted_at":"2026-01-30T17:03:24Z","title":"Universal Adversarial Attacks against Closed-Source MLLMs via Target-View Routed Meta Optimization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T09:26:14.799360Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2601.23179"},"observation_digest":"sha256:33b9249044ba1c937af83fc28c684d437056531c4712e152f3c73d45d4be8f8f","observation_id":"8a86ff78-7cc6-4025-aba1-4b0d1c0c270c","resolution":{"observed_at":"2026-05-16T09:27:40.973099Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2604.09253","last_updated":"2026-04-10T12:09:06Z","snapshot_observed_at":"2026-07-06T22:58:12.847181Z","submitted_at":"2026-04-10T12:09:06Z","title":"Mosaic: Multimodal Jailbreak against Closed-Source VLMs via Multi-View Ensemble Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T18:03:36.805784Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2604.09253"},"observation_digest":"sha256:0f7d5662cce9e2538dcc004ef6f5ee56ea786fd6d66bf7c909cda292dddb5a1d","observation_id":"b7cf3046-9cbb-4aa6-969c-a972b9a70890","resolution":{"observed_at":"2026-05-11T05:35:59.178907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2605.09902","last_updated":"2026-05-11T02:45:48Z","snapshot_observed_at":"2026-07-06T23:21:54.140120Z","submitted_at":"2026-05-11T02:45:48Z","title":"Adversarial Attacks Against MLLMs via Progressive Resolution Processing and Adaptive Feature Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:31.570783Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2605.09902"},"observation_digest":"sha256:9437d65db39516b9847c3ccebab1115967c7b469f780924256ac3165452a137a","observation_id":"50504f78-419d-4279-a532-7846a7ccc129","resolution":{"observed_at":"2026-05-12T06:21:27.955839Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2605.18868","last_updated":"2026-05-15T12:28:16Z","snapshot_observed_at":"2026-08-02T22:00:15.007211Z","submitted_at":"2026-05-15T12:28:16Z","title":"DarkLLM: Learning Language-Driven Adversarial Attacks with Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T18:31:48.770507Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2605.18868"},"observation_digest":"sha256:ffb7063e275723599ce13adc4359da6e900b8c3118c3e6271c2c8e8b4a2c93bc","observation_id":"b6f53335-55b6-46a9-9415-5f5118429e7c","resolution":{"observed_at":"2026-05-20T18:33:37.919303Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2605.29602","last_updated":"2026-05-28T08:40:34Z","snapshot_observed_at":"2026-07-31T08:03:40.151420Z","submitted_at":"2026-05-28T08:40:34Z","title":"CogniVerse: Revolutionizing Multi-Modal Retrieval-Augmented Generation with Cognitive Reflection and Geometric Reasoning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-29T08:14:20.558527Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2605.29602"},"observation_digest":"sha256:13fdff0e5ee4910ca12841647ae0792ab4d81a9f5111271ebd1adc7e4280827f","observation_id":"c77dc30e-d393-4c5b-91c3-47d074ce88e6","resolution":{"observed_at":"2026-06-29T08:23:15.763386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2606.23892","last_updated":"2026-06-22T19:41:57Z","snapshot_observed_at":"2026-08-06T14:11:51.998297Z","submitted_at":"2026-06-22T19:41:57Z","title":"REALM: A Unified Red-Teaming Benchmark for Physical-World VLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-26T08:44:45.853401Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2606.23892"},"observation_digest":"sha256:97ed6cfc23cc8907ec4b1dda8b724cce030ae61d8245fd429a012301e53017a8","observation_id":"66e48b9e-d251-4a04-ac7d-ecc359911ffe","resolution":{"observed_at":"2026-07-04T10:29:45.732836Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2606.26199","last_updated":"2026-06-26T02:47:28Z","snapshot_observed_at":"2026-07-07T00:00:31.981360Z","submitted_at":"2026-06-24T16:23:10Z","title":"MIRAGE: Protecting against Malicious Image Editing via False Moderation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T01:52:12.291420Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2606.26199"},"observation_digest":"sha256:451919ec2205d3dde553ad0fdafe748c04dcb75b5084ad2270c5dd5e85f5b9f5","observation_id":"aa01307b-df84-46ea-bef2-bf5abc3ae45a","resolution":{"observed_at":"2026-07-04T15:09:54.649235Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2606.26199","last_updated":"2026-06-26T02:47:28Z","snapshot_observed_at":"2026-07-07T00:00:31.981360Z","submitted_at":"2026-06-24T16:23:10Z","title":"MIRAGE: Protecting against Malicious Image Editing via False Moderation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-29T04:46:56.552601Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2606.26199"},"observation_digest":"sha256:5bb9463f0eb7d8bad52695ec3fd6aefad190f9642d8186b7694bbf9b08f8b9d2","observation_id":"9268db2d-a89a-4bb6-9779-924540dce770","resolution":{"observed_at":"2026-06-29T19:13:53.523673Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-12T01:35:43.979206Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03562","last_updated":"2026-07-03T18:52:42Z","snapshot_observed_at":"2026-08-07T06:14:13.409347Z","submitted_at":"2026-07-03T18:52:42Z","title":"XPlainVerse: A Million-Scale Benchmark for Explainable Deepfake Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T01:35:43.979206Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2607.03562"},"observation_digest":"sha256:ea55d05f5f9175c0b947f88ff68e49a8bdc0133e48ae1401569144d5442676e2","observation_id":"56724a41-4eb3-4444-bf07-4892ab00bc0f","resolution":{"observed_at":"2026-07-12T01:35:43.979206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"cited_work":{"arxiv_id":"2505.21494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21494","snapshot_observed_at":"2026-07-09T12:56:14.862810Z","title":"Adversarial attacks against closed-source mllms via feature optimal alignment","venue":"cs.CV","work_id":"e1920300-ede7-411f-bd86-745faa09b9b0","year":2025},"citing_paper":{"arxiv_id":"2607.07375","last_updated":"2026-07-08T13:06:20Z","snapshot_observed_at":"2026-08-03T20:22:35.302558Z","submitted_at":"2026-07-08T13:06:20Z","title":"On Adversarial Vulnerability of Vision-Language Models through the Lens of Intermediate Spectral Subspaces","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-09T12:55:34.631248Z"},"links":{"cited_paper":"/paper/2505.21494","citing_paper":"/paper/2607.07375"},"observation_digest":"sha256:c85eb18e8ef053c59257a513654fd7ab269c50130f6ae4637c92aae9ff1ebaa8","observation_id":"02808c47-6ced-4729-bbde-4aaa411a6f22","resolution":{"observed_at":"2026-07-09T12:56:14.864124Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21494/citation-record","integrity":"/paper/2505.21494/integrity","json":"/paper/2505.21494/citation-record.json","paper":"/paper/2505.21494"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T13:35:49.458315Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.458315Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:b9fc1f054d70d9b3aae87db9267128c48b7162551b62fd20f01cd676ac9f7a7a","observation_id":"d6d6c590-42d6-41b0-822e-10ef275b5588","resolution":{"observed_at":"2026-08-07T13:35:49.458315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:49.567080Z","title":"Flamingo: a visual language model for few-shot learning.Advances in Neural Information Processing Systems, 35: 23716–23736, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.567080Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:b36b5b6eeb4d3bf2dc297e102c9a6e90436092fd695f440b57c9139f3bf1022e","observation_id":"53aba7bc-ad04-4371-a30b-c53603628214","resolution":{"observed_at":"2026-08-07T13:35:49.567080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10403","last_updated":"2023-09-13T20:35:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T17:46:53Z","title":"PaLM 2 Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10403","snapshot_observed_at":"2026-08-07T13:35:49.671246Z","title":"Palm 2 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.671246Z"},"links":{"cited_paper":"/paper/2305.10403","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:3a642b05a81c11a69002b0f698cb95bbd8523bcd76bf690cf87052b190afdc7a","observation_id":"debd7b32-c2c1-4a71-b9b7-6aa7a6b85f88","resolution":{"observed_at":"2026-08-07T13:35:49.671246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00236","last_updated":"2024-09-17T19:56:09Z","snapshot_observed_at":"2026-08-06T06:17:45.496933Z","submitted_at":"2023-09-01T03:53:40Z","title":"Image Hijacks: Adversarial Images can Control Generative Models at Runtime","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00236","snapshot_observed_at":"2026-08-07T13:35:49.779331Z","title":"Image hijacks: Adversarial images can control generative models at runtime.arXiv preprint arXiv:2309.00236, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.779331Z"},"links":{"cited_paper":"/paper/2309.00236","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:901ba01f9cea27b69f0fd4c35af8d603d5a2139cad6bf7887c764afca7cfded5","observation_id":"4039150c-a3ae-444f-a8b0-24972fc7bc92","resolution":{"observed_at":"2026-08-07T13:35:49.779331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:59.935321Z","title":"Improv- ing the transferability of targeted adversarial examples through object-based diverse input","venue":null,"work_id":"2e917e98-0098-4082-b4b3-66bad67d488f","year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:49.904749Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:1be9bac6f6f89be0c1f3b32235109412364b9aade3ad19cfe5e2d62aa0aa0338","observation_id":"f873176d-2936-4a92-920e-f26e041679cc","resolution":{"observed_at":"2026-08-07T13:36:00.005359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:50.024648Z","title":"Towards evaluating the robustness of neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.024648Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:22c04928e2b4811908c395e73757eeac8b3e36cafecf9c06db36d4d6aecfd866","observation_id":"d50c7d2c-baf9-477d-b570-0939cca85bf2","resolution":{"observed_at":"2026-08-07T13:35:50.024648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.15447","last_updated":"2024-05-06T06:36:24Z","snapshot_observed_at":"2026-08-03T21:29:11.660688Z","submitted_at":"2023-06-26T17:18:44Z","title":"Are aligned neural networks adversarially aligned?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.15447","snapshot_observed_at":"2026-08-07T13:35:50.164811Z","title":"Are aligned neural networks adversarially aligned?arXiv preprint arXiv:2306.15447, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.164811Z"},"links":{"cited_paper":"/paper/2306.15447","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:14720d3c424cb521f6cd1dbf4f66d2929f621799c4a346992c91e9fe41b93b07","observation_id":"77e1130e-de80-4e79-896e-53283f08cf13","resolution":{"observed_at":"2026-08-07T13:35:50.164811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09105","last_updated":"2024-03-04T11:30:06Z","snapshot_observed_at":"2026-08-07T09:14:57.287507Z","submitted_at":"2023-03-16T06:37:16Z","title":"Rethinking Model Ensemble in Transfer-based Adversarial Attacks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09105","snapshot_observed_at":"2026-08-07T13:35:50.302743Z","title":"Rethinking model ensemble in transfer-based adversarial attacks.arXiv preprint arXiv:2303.09105, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.302743Z"},"links":{"cited_paper":"/paper/2303.09105","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:ee703ec9688f0d72bd833cfc019ae64df83e4971f1a76b1bb946d04aeec60108","observation_id":"cf1d090e-49ae-4a2f-8ac1-d4e618751a4b","resolution":{"observed_at":"2026-08-07T13:35:50.302743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:59.650163Z","title":"Palm: Scaling language modeling with pathways.Journal of Machine Learning Research, 24(240): 1–113, 2023","venue":null,"work_id":"68d7e235-dd95-4966-8cdf-f32ac69b3599","year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.455824Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:0694848f284bd653c3ba0eb99cdbc06ca361ae2860ceb4826f518da4949628f7","observation_id":"1f2b4431-a890-4e58-93da-2020e2a032a6","resolution":{"observed_at":"2026-08-07T13:35:59.801185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:59.377093Z","title":"A survey on multimodal large language models for autonomous driving","venue":null,"work_id":"4ac989b1-6035-4403-8fd8-b2baeec73f45","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.612019Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:027cb2a87cf54c4fec4c4f67911697befec2d1bfe8cf947f72228765647a2362","observation_id":"f09c250d-f3f8-40b9-944f-7b788bbe851c","resolution":{"observed_at":"2026-08-07T13:35:59.528956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:50.689362Z","title":"Sinkhorn distances: Lightspeed computation of optimal transport.Advances in neural information processing systems, 26, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.689362Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:0d8ee239715804351fcd9cfa7ea3a7ffe785b3eee925585ea0abb20b1daac086","observation_id":"533f328e-9d98-4975-9baf-de628077d6f1","resolution":{"observed_at":"2026-08-07T13:35:50.689362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.07623","last_updated":"2019-02-20T16:18:37Z","snapshot_observed_at":"2026-07-06T07:34:21.459028Z","submitted_at":"2019-02-20T16:18:37Z","title":"advertorch v0.1: An Adversarial Robustness Toolbox based on PyTorch","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.07623","snapshot_observed_at":"2026-08-07T13:35:50.841588Z","title":"AdverTorch v0.1: An adversarial robustness toolbox based on pytorch.arXiv preprint arXiv:1902.07623, 2019","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.841588Z"},"links":{"cited_paper":"/paper/1902.07623","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:5c7bbb3a9d3f65d3318f770eb048fefb9c9b74aad00756cb2a81ba189b4e24aa","observation_id":"73af7a46-2e2e-4348-8f04-7932ad257400","resolution":{"observed_at":"2026-08-07T13:35:50.841588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11751","last_updated":"2023-10-14T12:56:13Z","snapshot_observed_at":"2026-08-02T21:47:41.540245Z","submitted_at":"2023-09-21T03:24:30Z","title":"How Robust is Google's Bard to Adversarial Image Attacks?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11751","snapshot_observed_at":"2026-08-07T13:35:50.982242Z","title":"How robust is google’s bard to adversarial image attacks?arXiv preprint arXiv:2309.11751, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:50.982242Z"},"links":{"cited_paper":"/paper/2309.11751","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:d59acc249ae46898d9775cdecbd99e97b9e593f4c47b0a7266dd4aff832dfa75","observation_id":"fab8b3b2-4a32-4dcf-b09c-6f8515aa05db","resolution":{"observed_at":"2026-08-07T13:35:50.982242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T13:35:51.083696Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.083696Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:93739c48e846596af8a4cd16052b6a5894daad5a6daf2f7d49c88dcd21da3c47","observation_id":"373cb766-e746-4356-b191-4ad9c4dd6ed6","resolution":{"observed_at":"2026-08-07T13:35:51.083696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-07T13:35:51.204470Z","title":"Red teaming language models to reduce harms: Methods, scaling behaviors, and lessons learned.arXiv preprint arXiv:2209.07858, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.204470Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:c18af7b36092b09f15583416764213267a10fdf3ffcf8edbb08410c1ebc934a5","observation_id":"133529ae-b798-4bbb-ba8c-501f3debd4f7","resolution":{"observed_at":"2026-08-07T13:35:51.204470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.15010","last_updated":"2023-04-28T17:59:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-28T17:59:25Z","title":"LLaMA-Adapter V2: Parameter-Efficient Visual Instruction Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.15010","snapshot_observed_at":"2026-08-07T13:35:51.324640Z","title":"Llama-adapter v2: Parameter-efficient visual instruction model.arXiv preprint arXiv:2304.15010, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.324640Z"},"links":{"cited_paper":"/paper/2304.15010","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:9d53c9871b1f97a62a5f18dec3a7a93464a3cf8b8e230b5a625fb5b9355ad4bb","observation_id":"a5c23d5b-6673-41d0-a413-8aa5f2620c32","resolution":{"observed_at":"2026-08-07T13:35:51.324640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12445","last_updated":"2024-07-14T15:58:57Z","snapshot_observed_at":"2026-08-03T13:35:01.122031Z","submitted_at":"2024-03-19T05:10:10Z","title":"Boosting Transferability in Vision-Language Attacks via Diversification along the Intersection Region of Adversarial Trajectory","version":3},"cited_work":{"arxiv_id":"2403.12445","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.12445","snapshot_observed_at":"2026-08-07T13:35:57.483912Z","title":"Boosting Transferability in Vision-Language Attacks via Diversification along the Intersection Region of Adversarial Trajectory","venue":"cs.CV","work_id":"88104173-cb07-44f7-ac78-2bacd2359c4a","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.426223Z"},"links":{"cited_paper":"/paper/2403.12445","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:5bd6af0308748eeeb2068db70580059b570a2e4262f5946a21fc5af120dbe62c","observation_id":"87b55f07-3992-464a-b753-76803431ec0f","resolution":{"observed_at":"2026-08-07T13:35:57.575067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-07-06T04:04:16.777653Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-07T13:35:51.600167Z","title":"Goodfellow, Jonathon Shlens, and Christian Szegedy","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.600167Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:be43680571a9b22ceaac6ca922fc377d26ef61494acf7c6b2b4827d64f83854f","observation_id":"921febc2-46c8-4fdd-9ae1-3829b94e1aec","resolution":{"observed_at":"2026-08-07T13:35:51.600167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:59.165234Z","title":"Agent smith: A single image can jailbreak one million multimodal llm agents exponentially fast","venue":null,"work_id":"8709fdc3-573c-4de2-b170-f0780520945a","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.708519Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:2c751b185d36b99d9e93052ef770593694836ef577d9650b7750f40bff29c8db","observation_id":"a67fab29-5b17-4fa7-8ecb-2d2a3aa6c4e2","resolution":{"observed_at":"2026-08-07T13:35:59.227279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.00117","last_updated":"2018-01-25T19:04:48Z","snapshot_observed_at":"2026-07-06T06:07:07.703002Z","submitted_at":"2017-10-31T21:22:16Z","title":"Countering Adversarial Images using Input Transformations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.00117","snapshot_observed_at":"2026-08-07T13:35:51.819305Z","title":"Countering adversarial images using input transformations.arXiv preprint arXiv:1711.00117, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.819305Z"},"links":{"cited_paper":"/paper/1711.00117","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:c15a035815acc12f8b196591ffb6ea16d75b77f685f1fc7b43de575e61ba9ac9","observation_id":"eaea06a7-6d6a-4179-bcd4-d5652491a65b","resolution":{"observed_at":"2026-08-07T13:35:51.819305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:51.945845Z","title":"Efficient generation of targeted and transferable adversarial examples for vision-language models via diffusion models.IEEE Transactions on Information Forensics and Security, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:51.945845Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:688e15809a8f2c5900ee3c7acdf16c22a834284eed44a6bb19beb74dea410f42","observation_id":"e4e90e0d-4279-4e19-9fd2-1ff88e579ba3","resolution":{"observed_at":"2026-08-07T13:35:51.945845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04403","last_updated":"2023-12-07T16:16:50Z","snapshot_observed_at":"2026-08-02T17:13:23.195883Z","submitted_at":"2023-12-07T16:16:50Z","title":"OT-Attack: Enhancing Adversarial Transferability of Vision-Language Models via Optimal Transport Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04403","snapshot_observed_at":"2026-08-07T13:35:52.106307Z","title":"Ot-attack: En- hancing adversarial transferability of vision-language models via optimal transport optimization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.106307Z"},"links":{"cited_paper":"/paper/2312.04403","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:55b54f151406867a3e6a410719aca99ecdbebfd5b435194933abbdd5d02c03f0","observation_id":"298d6280-0ced-4e25-beb5-41c086266e93","resolution":{"observed_at":"2026-08-07T13:35:52.106307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04913","last_updated":"2023-12-08T09:08:50Z","snapshot_observed_at":"2026-08-07T21:16:58.470052Z","submitted_at":"2023-12-08T09:08:50Z","title":"SA-Attack: Improving Adversarial Transferability of Vision-Language Pre-training Models via Self-Augmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.04913","snapshot_observed_at":"2026-08-07T13:35:52.215725Z","title":"Sa- attack: Improving adversarial transferability of vision-language pre-training models via self- augmentation.arXiv preprint arXiv:2312.04913, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.215725Z"},"links":{"cited_paper":"/paper/2312.04913","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:16f9f53738aca8db4266b13f8274cbcce6cf0c67cc6b57e537957ae1828e367f","observation_id":"ecdbbe7a-cca9-4aa1-9760-674bf2d4c7be","resolution":{"observed_at":"2026-08-07T13:35:52.215725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14045","last_updated":"2023-03-01T11:04:51Z","snapshot_observed_at":"2026-08-08T05:52:17.343895Z","submitted_at":"2023-02-27T18:55:27Z","title":"Language Is Not All You Need: Aligning Perception with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14045","snapshot_observed_at":"2026-08-07T13:35:52.279416Z","title":"Language is not all you need: Aligning perception with language models.arXiv preprint arXiv:2302.14045, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.279416Z"},"links":{"cited_paper":"/paper/2302.14045","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:3650bbccf00350ed94cec2b180f23e51c2c7581dd82bbb97b14607d62b1e1728","observation_id":"a65dbc69-8253-457c-8d16-faa8cab41031","resolution":{"observed_at":"2026-08-07T13:35:52.279416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-07T13:35:52.404988Z","title":"Vision-r1: Incentivizing reasoning capability in multimodal large language models.arXiv preprint arXiv:2503.06749, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.404988Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:aa3789534dbb0ea9a4a202de513356e3c0afaa54199e48de01e01534a0c8ecb6","observation_id":"a5854e17-ed80-4b06-9ea0-d8fe21ed1b1f","resolution":{"observed_at":"2026-08-07T13:35:52.404988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.974241Z","title":"Comdefend: An efficient image compression model to defend adversarial examples","venue":null,"work_id":"d696f330-7e0a-42b1-9797-6fb9711e5392","year":2019},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.527419Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:a996c069f00c3ee05e61cae4f79c79c8eaf4ebaae03bfa3c962093d00a0e8dbd","observation_id":"58a8fe99-1638-4ad1-ad42-378876adc7ce","resolution":{"observed_at":"2026-08-07T13:35:59.077875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:52.599556Z","title":"Natural language understanding and inference with mllm in visual question answering: A survey.ACM Computing Surveys, 57(8):1–36, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.599556Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:fae791efa1f9d6e7ea5a41e78ab1efc5c102ccbfe4548bc6fb4ed1083e7b8463","observation_id":"61b1cab7-2e3e-4b9b-b51b-1b94c1248c2b","resolution":{"observed_at":"2026-08-07T13:35:52.599556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12597","last_updated":"2023-06-15T07:57:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-01-30T00:56:51Z","title":"BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12597","snapshot_observed_at":"2026-08-07T13:35:52.680342Z","title":"Blip-2: Bootstrapping language- image pre-training with frozen image encoders and large language models.arXiv preprint arXiv:2301.12597, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.680342Z"},"links":{"cited_paper":"/paper/2301.12597","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:32414eead413953b6a5397acfd97c7e5942808e1d007f6a837bb8c6973af9182","observation_id":"6a34e8f0-e763-46c1-86b4-a2962d01d0e2","resolution":{"observed_at":"2026-08-07T13:35:52.680342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-07T13:35:52.839627Z","title":"Videochat: Chat-centric video understanding.arXiv preprint arXiv:2305.06355, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.839627Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:d216a0187c2df07e8892dfd6750544b3cf1b2becd883dbe8417ea287c28b3b58","observation_id":"23b3972f-bd30-42bf-b519-bc4af4101549","resolution":{"observed_at":"2026-08-07T13:35:52.839627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.810833Z","title":"Improving context understanding in multimodal large language models via multimodal composition learning","venue":null,"work_id":"81cb0193-c2db-4475-acec-d8ecce1f3bc7","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:52.951027Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:46e6e6dd941b54c6bdc50938b4aa5cf0ed236692401c8093bc933ef79ec6e669","observation_id":"b1e487e3-63f5-4fad-a7f3-e0ebddded0ca","resolution":{"observed_at":"2026-08-07T13:35:58.883171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:53.099184Z","title":"A frustratingly simple yet highly effective attack baseline: Over 90% success rate against the strong black-box models of gpt-4.5/4o/o1.arXiv preprint arXiv:2503.10635, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.099184Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:cc856586bacddc0e90134bb3da6ccc18fb005f246b51ab67929b89918eb421c0","observation_id":"67fd2408-7657-47dc-80fd-02e433a518b1","resolution":{"observed_at":"2026-08-07T13:35:53.099184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13980","last_updated":"2024-09-21T02:10:19Z","snapshot_observed_at":"2026-07-06T19:19:06.790588Z","submitted_at":"2024-09-21T02:10:19Z","title":"Enhancing Advanced Visual Reasoning Ability of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13980","snapshot_observed_at":"2026-08-07T13:35:53.235556Z","title":"Enhancing advanced visual reasoning ability of large language models.arXiv preprint arXiv:2409.13980, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.235556Z"},"links":{"cited_paper":"/paper/2409.13980","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:35532b90632ed667dd1de130ba3dff24f057db28074b072132d8cec3125d89bc","observation_id":"3787a6af-926e-4f33-a16f-c8057a359b74","resolution":{"observed_at":"2026-08-07T13:35:53.235556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:53.358879Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.358879Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:155a41c7000e353e3728310897a75f1351afd218e63dc1fa752367afe0ddadd0","observation_id":"d06aba4f-4b63-4865-833a-368c781dd20f","resolution":{"observed_at":"2026-08-07T13:35:53.358879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-07T13:35:53.444061Z","title":"Visual instruction tuning.arXiv preprint arXiv:2304.08485, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.444061Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:a53324fabd33cd1a6eb00c4a2e2bbb55cadc6db7ebbdb38da6f7245f0ac33c40","observation_id":"d4c1560e-d017-4d83-9100-354e2efb8419","resolution":{"observed_at":"2026-08-07T13:35:53.444061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:53.528417Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.528417Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:813ebfbf943fff83d7843237c3cbbf4eaa30cab91d7843636d9b5687e96a1baf","observation_id":"df524861-71a2-4380-9ea3-11c54cc2b1ef","resolution":{"observed_at":"2026-08-07T13:35:53.528417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00357","last_updated":"2024-06-20T15:06:10Z","snapshot_observed_at":"2026-07-06T17:23:31.057358Z","submitted_at":"2024-02-01T05:57:10Z","title":"Safety of Multimodal Large Language Models on Images and Texts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00357","snapshot_observed_at":"2026-08-07T13:35:53.646908Z","title":"Safety of multimodal large language models on images and text.arXiv preprint arXiv:2402.00357, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.646908Z"},"links":{"cited_paper":"/paper/2402.00357","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:739a539f7456cad3c2dab4b7c59359c83c34e2dd28dcb061fcc76ec82021c4d4","observation_id":"cccdc95a-89aa-4648-9e47-aaf4bb2cc0e4","resolution":{"observed_at":"2026-08-07T13:35:53.646908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13860","last_updated":"2024-03-10T13:58:08Z","snapshot_observed_at":"2026-07-06T15:31:18.144952Z","submitted_at":"2023-05-23T09:33:38Z","title":"Jailbreaking ChatGPT via Prompt Engineering: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13860","snapshot_observed_at":"2026-08-07T13:35:53.728471Z","title":"Jailbreaking chatgpt via prompt engineering: An empirical study.arXiv preprint arXiv:2305.13860, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.728471Z"},"links":{"cited_paper":"/paper/2305.13860","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:304a448a2f8b44a2fac7142d6f719fbd00b9479a8db3c3c5fc3fdbaac66677fd","observation_id":"7730ddf2-4184-494a-a4b0-0763b5c50bca","resolution":{"observed_at":"2026-08-07T13:35:53.728471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:53.862054Z","title":"Frequency domain model augmentation for adversarial attack","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.862054Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:fe072de980a2dc8502dba7b24269ebf602cadb741c985a9db2cdec38cb4f513c","observation_id":"30817079-a523-4f02-92f4-a08dc790a7db","resolution":{"observed_at":"2026-08-07T13:35:53.862054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.696038Z","title":"Questioning, answering, and captioning for zero-shot detailed image caption","venue":null,"work_id":"1a484115-29eb-4e71-850f-3ce3e449e634","year":2024},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:53.960674Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:c8d0474aa735eeb86826d498454d5ec10b213001802d035ca8a9bc3b839f6f9a","observation_id":"7a66557e-295c-44d8-a4b5-c70850689098","resolution":{"observed_at":"2026-08-07T13:35:58.732394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-07T13:35:54.066433Z","title":"Video-chatgpt: Towards detailed video understanding via large vision and language models.arXiv preprint arXiv:2306.05424, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.066433Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:e9d9ce80c57cf4e3b30188ef7d03059a58b890e9ef8e6b9c5b65357b54d9843d","observation_id":"051b4a18-41c9-48cb-afad-412c5ced3412","resolution":{"observed_at":"2026-08-07T13:35:54.066433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-07T13:35:54.172351Z","title":"Towards deep learning models resistant to adversarial attacks.arXiv preprint arXiv:1706.06083, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.172351Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:e9c38b4fa9b3a1b0a29dd0f3470d3a47f054b0b6200b97d78b7f6679344ffef2","observation_id":"d82267be-1595-454c-b0c4-e8fdd0f97725","resolution":{"observed_at":"2026-08-07T13:35:54.172351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:54.277385Z","title":"Training language models to follow instructions with human feedback.Advances in Neural Information Processing Systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.277385Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:35d4861f25bc7e8ba154c6bf03c0aaf8de096e3e45970ba755ca50e67ed06357","observation_id":"046113fe-17c2-41ff-af41-47069a38b3b9","resolution":{"observed_at":"2026-08-07T13:35:54.277385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-07T13:35:54.349572Z","title":"Red teaming language models with language models.arXiv preprint arXiv:2202.03286, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.349572Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:352f77911a44a62473f66c780de1b4c14e2d03e773babbea9dfa86bad7b581e9","observation_id":"b82bf650-0879-43e3-8872-4fd8ccc39a5f","resolution":{"observed_at":"2026-08-07T13:35:54.349572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:54.443770Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.443770Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:0e2f8d7f29005284b598d4dbd83115ca59acea87cfb300619ef2d370879f6a6b","observation_id":"b6913d6d-2efe-4ffd-8948-bf8520245544","resolution":{"observed_at":"2026-08-07T13:35:54.443770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14604","last_updated":"2025-05-30T14:11:25Z","snapshot_observed_at":"2026-08-07T16:54:03.834023Z","submitted_at":"2025-03-18T18:03:56Z","title":"Image Captioning Evaluation in the Age of Multimodal LLMs: Challenges and Future Perspectives","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14604","snapshot_observed_at":"2026-08-07T13:35:54.549170Z","title":"Image captioning evaluation in the age of multimodal llms: Challenges and future perspectives.arXiv preprint arXiv:2503.14604, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.549170Z"},"links":{"cited_paper":"/paper/2503.14604","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:48300231a0c7654963ab966d9bc851e4d680323da99d827dc242e7f6c9b52540","observation_id":"184826b5-a3fe-4e46-b094-04f2eb32be00","resolution":{"observed_at":"2026-08-07T13:35:54.549170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-07T13:35:54.659888Z","title":"Bloom: A 176b-parameter open-access multilingual language model.arXiv preprint arXiv:2211.05100, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.659888Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:aa5f5a1cab7d65e8ac65ff7ddc1f0ff9a3bdb98ed0c90947bff68bc0626751e6","observation_id":"6f82d06b-9593-4a8f-b71d-ef1caed492b3","resolution":{"observed_at":"2026-08-07T13:35:54.659888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:54.845752Z","title":"On the adversarial robustness of multi-modal founda- tion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.845752Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:f177b079b6e24d8b380cc76fa6ef7f16679fc8bfdb55e0a298674ef801c7b9a6","observation_id":"07540c05-12cb-4f1c-b301-a6e7051a9fe8","resolution":{"observed_at":"2026-08-07T13:35:54.845752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16355","last_updated":"2023-05-25T04:16:07Z","snapshot_observed_at":"2026-08-02T07:50:35.580500Z","submitted_at":"2023-05-25T04:16:07Z","title":"PandaGPT: One Model To Instruction-Follow Them All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16355","snapshot_observed_at":"2026-08-07T13:35:54.954745Z","title":"Pandagpt: One model to instruction-follow them all.arXiv preprint arXiv:2305.16355, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:54.954745Z"},"links":{"cited_paper":"/paper/2305.16355","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:14d3ea73fc8bb000dcf9cec661fcadbca26be070f58bbe543b390af7f0228113","observation_id":"fa667496-da25-46f1-8041-c67904e0c053","resolution":{"observed_at":"2026-08-07T13:35:54.954745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T13:35:55.040125Z","title":"Llama: Open and efficient foundation language models.arXiv preprint arXiv:2302.13971, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.040125Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:0e9f45d8e60ebeefdf431eb73f3ae11b34d8a5d157d60bf023240b10974e9cd0","observation_id":"c570df1d-1fa9-4844-bc50-6962a1af0081","resolution":{"observed_at":"2026-08-07T13:35:55.040125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T13:35:55.132411Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.132411Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:cca325cea0a125944b63d08d21874086348cadd2110889ab9d5e376c63227377","observation_id":"237911bb-7dd7-4e92-9109-59936103a8e5","resolution":{"observed_at":"2026-08-07T13:35:55.132411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:55.254426Z","title":"Multimodal few-shot learning with frozen language models.Advances in Neural Information Processing Systems, 34:200–212, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.254426Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:e085df6586e812ea69694161f0382e6c958d207d2c91eac96f2a1a4f6f8016e0","observation_id":"d9988ab8-1bc9-4f7c-a53c-e55133945edb","resolution":{"observed_at":"2026-08-07T13:35:55.254426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16101","last_updated":"2023-11-27T18:59:42Z","snapshot_observed_at":"2026-08-08T00:07:32.122707Z","submitted_at":"2023-11-27T18:59:42Z","title":"How Many Unicorns Are in This Image? A Safety Evaluation Benchmark for Vision LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16101","snapshot_observed_at":"2026-08-07T13:35:55.414755Z","title":"How many unicorns are in this image? a safety evaluation benchmark for vision llms.arXiv preprint arXiv:2311.16101, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.414755Z"},"links":{"cited_paper":"/paper/2311.16101","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:e793557fa7ab9fed2f0a9c802aebb9cafcf91e7bddf0b8d97f3f39cdca444c53","observation_id":"cf22a302-1e01-4e57-b838-dfdc96986a09","resolution":{"observed_at":"2026-08-07T13:35:55.414755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:55.501406Z","title":"Springer, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.501406Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:344e7aedd48b7b35ac9b8ade5d2b768865dfe45f3ed9ee24a238dbcfebd32c7d","observation_id":"b25bbc94-ba7f-4cd9-9b70-0e19cf893dba","resolution":{"observed_at":"2026-08-07T13:35:55.501406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01886","last_updated":"2024-06-26T03:29:50Z","snapshot_observed_at":"2026-08-03T09:13:22.955433Z","submitted_at":"2023-12-04T13:40:05Z","title":"InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01886","snapshot_observed_at":"2026-08-07T13:35:55.625791Z","title":"Instructta: Instruction- tuned targeted attack for large vision-language models.arXiv preprint arXiv:2312.01886, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.625791Z"},"links":{"cited_paper":"/paper/2312.01886","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:4a367d8fc737948d1b86eaa0053e68f0785a1ee0d2bc9700a73a41539c84dd66","observation_id":"8311a177-207b-4aaa-be9e-ff012ab7ce2b","resolution":{"observed_at":"2026-08-07T13:35:55.625791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.606743Z","title":"Black-box sparse adversarial attack via multi-objective optimisation","venue":null,"work_id":"ef4ca609-a764-46b8-b214-2c26f3c65a79","year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.753909Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:01cd25953d1f63ea4878d237ca614fa200590e8444b77800eb72bf1eb756982b","observation_id":"cf193db2-d84d-4f48-897e-ebee42b7be9a","resolution":{"observed_at":"2026-08-07T13:35:58.611990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04671","last_updated":"2023-03-08T15:50:02Z","snapshot_observed_at":"2026-07-06T15:00:13.368355Z","submitted_at":"2023-03-08T15:50:02Z","title":"Visual ChatGPT: Talking, Drawing and Editing with Visual Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04671","snapshot_observed_at":"2026-08-07T13:35:55.844596Z","title":"Visual chatgpt: Talking, drawing and editing with visual foundation models.arXiv preprint arXiv:2303.04671, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.844596Z"},"links":{"cited_paper":"/paper/2303.04671","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:091cc2af77213daa56017b795af9dc81b89e951cda1af3806236291726d66ac4","observation_id":"9a79c70a-161c-46af-9692-6c381a109884","resolution":{"observed_at":"2026-08-07T13:35:55.844596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.297726Z","title":"An empirical study of gpt-3 for few-shot knowledge-based vqa","venue":null,"work_id":"3f6bfbcf-5d73-4c1b-8192-2823720f2c3b","year":2022},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.913819Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:fe38e33a94a50a0317dcf5d3e3eb77a502b3a747f7a55df0b7cf3ad6ee4cfb06","observation_id":"8972e13b-5038-458c-90c2-34d09d3499e8","resolution":{"observed_at":"2026-08-07T13:35:58.453771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05346","last_updated":"2025-03-28T02:55:23Z","snapshot_observed_at":"2026-08-02T11:44:11.377758Z","submitted_at":"2024-10-07T09:45:18Z","title":"AnyAttack: Towards Large-scale Self-supervised Adversarial Attacks on Vision-language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05346","snapshot_observed_at":"2026-08-07T13:35:55.980677Z","title":"Anyattack: Towards large-scale self-supervised generation of targeted adversarial examples for vision-language models.arXiv preprint arXiv:2410.05346, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:55.980677Z"},"links":{"cited_paper":"/paper/2410.05346","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:a275c20a29839192fd9e0370fdf7c285e3270580074998a05a261dcd904c9332","observation_id":"9c5b7731-6173-402f-bac8-5f34f612c299","resolution":{"observed_at":"2026-08-07T13:35:55.980677Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16934","last_updated":"2023-10-29T12:32:19Z","snapshot_observed_at":"2026-07-06T15:33:57.659685Z","submitted_at":"2023-05-26T13:49:44Z","title":"On Evaluating Adversarial Robustness of Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16934","snapshot_observed_at":"2026-08-07T13:35:56.073322Z","title":"On evaluating adversarial robustness of large vision-language models.arXiv preprint arXiv:2305.16934, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.073322Z"},"links":{"cited_paper":"/paper/2305.16934","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:cda6c7959fc7ab352d9a46e96a37f873fdf1762858dca27e20a1b6cf3364cb44","observation_id":"b088cfe2-7099-4481-9238-10f15653e530","resolution":{"observed_at":"2026-08-07T13:35:56.073322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-07T13:35:56.169643Z","title":"Minigpt-4: En- hancing vision-language understanding with advanced large language models.arXiv preprint arXiv:2304.10592, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.169643Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:88b7a6a38f0b7987a6784d167e13afc35fbf9b1e6a969d489d9b332c0a216ffd","observation_id":"c82e27a2-fcc2-4b7a-9455-2e7e870501b1","resolution":{"observed_at":"2026-08-07T13:35:56.169643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:58.099011Z","title":"Boosting transferability of targeted adversarial examples with non-robust feature alignment.Expert Systems with Applications, 227:120248, 2023","venue":null,"work_id":"d881d2d4-38d0-4458-b85f-aa2c52ca585f","year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.253126Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:f3a667cba756221ed1e75ddd3a6ef2c4df435bc2f6a4453bc7a45f5d413123f3","observation_id":"49f3875c-3f69-4970-91e3-01b9fe572376","resolution":{"observed_at":"2026-08-07T13:35:58.180366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04528","last_updated":"2024-07-16T07:29:49Z","snapshot_observed_at":"2026-08-07T20:45:44.253504Z","submitted_at":"2023-06-07T15:37:00Z","title":"PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04528","snapshot_observed_at":"2026-08-07T13:35:56.355578Z","title":"Promptbench: Towards evaluating the robustness of large language models on adversarial prompts.arXiv preprint arXiv:2306.04528, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.355578Z"},"links":{"cited_paper":"/paper/2306.04528","citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:bb50adfc97be9aac0d17a3c2a9c64816d4573b440013c175a2068b5fcd2306d5","observation_id":"02365128-d5a3-4427-853b-65671b5f5a03","resolution":{"observed_at":"2026-08-07T13:35:56.355578Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:56.434228Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.434228Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:1f76570f46a5000b423e85e699ec8f599c33c013e0df629d96c6201233c4d85d","observation_id":"4e3ec945-1a16-4750-9926-157e393c97ba","resolution":{"observed_at":"2026-08-07T13:35:56.434228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:56.529699Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.529699Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:6d9d5391143a6e21aac1a15df3bb34eaa1297ac12e012744bfe8fb59625ffc4b","observation_id":"66e458ea-c708-46e0-ac33-0e1342c1c617","resolution":{"observed_at":"2026-08-07T13:35:56.529699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:56.615468Z","title":"Focus on **whether both descriptions fundamentally describe the same thing.**","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.615468Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:7698af67ee7eccf18805998aa26430d32aea4cbca4aecd38ff4fa600c07f4ea0","observation_id":"9102bc7d-9cd1-4e9f-9cdb-cb94c64b4694","resolution":{"observed_at":"2026-08-07T13:35:56.615468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:56.727415Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.727415Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:e31796f0f1f5599f79a9934cf720edada05af0f43c5dfaeb32f4e6b10fb1da6b","observation_id":"7ad76c61-c4b0-44d4-94bc-a818c5a2ba9a","resolution":{"observed_at":"2026-08-07T13:35:56.727415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:35:57.819353Z","title":"{input_text_1}","venue":null,"work_id":"77d121f7-5dff-47e3-8892-e5abe54e6039","year":null},"citing_paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T13:35:56.832563Z"},"links":{"citing_paper":"/paper/2505.21494"},"observation_digest":"sha256:88be4889e994867719e5fbbf9af76f7fd73987ef30714183d998472517e82059","observation_id":"e8aa0a1f-03e6-45f3-9920-6fe284f78bb6","resolution":{"observed_at":"2026-08-07T13:35:57.923750Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21494","last_updated":"2025-05-27T17:56:57Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T21:17:47.870634Z","submitted_at":"2025-05-27T17:56:57Z","title":"Adversarial Attacks against Closed-Source MLLMs via Feature Optimal Alignment"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":54,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 13 inbound Pith citation observations for arXiv:2505.21494."}