{"as_of":"2026-07-22T06:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a9ae413ae28681da5f38fc3da0ff40f1659d7b90bb0da8c7813bb55cd9e9ac15","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T14:07:56.386933Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-07-22T06:31:00.163083+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.17341/citation-record","integrity":"/paper/2605.17341/integrity","json":"/paper/2605.17341/citation-record.json","paper":"/paper/2605.17341"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The claude 3 model family: Opus, sonnet, haiku","venue":null,"work_id":"70341ff1-fb81-49cb-9018-d2b25a170a9b","year":null},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:a5b19b5408c972b96cfc6432bb788f70871e40fec1b1dc8d5c01a3879041b75e","observation_id":"d5f70058-0b95-4466-a41d-bca2488068d0","resolution":{"observed_at":"2026-05-20T14:08:21.363085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"20c09d9d-227d-4849-9f0f-05d686b24f9f","year":null},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:ce40f1f2ab22c22ec3cceb7223997423a0aacbe8860968973ecd9c444c3cca15","observation_id":"207d9e11-ab14-42e4-9ca5-33313ec77f83","resolution":{"observed_at":"2026-05-20T14:08:21.378372Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:e64b4934f70c6331c77946b0e372b5db3394f0c31280880e3cba301953538199","observation_id":"52b85ff4-ec21-4d2d-956c-f225c163f446","resolution":{"observed_at":"2026-05-20T14:08:20.931018Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5724.349588","doi":"10.5555/3495724.3495883","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Yi: Open foundation models by 01.ai","venue":null,"work_id":"3c5d9f39-12ca-4979-bedd-e375c6caa022","year":2020},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:07cf20dd6a6dfcacfec9175df623cbf95849193a850db0337740c9f91314c36a","observation_id":"78e87847-3488-489d-8fc4-cc3c16ab413d","resolution":{"observed_at":"2026-05-20T14:08:20.289410Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-05-23T13:52:43.181908+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T13:52:43.181908+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6214.2022","doi":"10.1109/sp46214.2022","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Spinning Language Models: Risks of Propaganda-As-A-Service and Countermeasures , url=","venue":null,"work_id":"fb02aee4-6896-426b-81d9-d3bf226deddf","year":2022},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:ff0eb737cbe417fb2965f8be7e5ec6b7e88b6641f8b648a803c1b26d5f2d61f8","observation_id":"7476436a-c55a-4f3d-9ce7-b243ba11ec31","resolution":{"observed_at":"2026-05-20T14:08:20.299638Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Extracting training data from diffusion models","venue":null,"work_id":"ecb9b3d9-07c5-43f3-8c98-4913591e5898","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:addfd69dd46e865e5814debc64801ed3687002ccc33a4c944b08526a9ff4eb74","observation_id":"3444519f-be4e-4d93-967b-f66582565795","resolution":{"observed_at":"2026-05-20T14:08:21.366901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The secret sharer: Evalu- ating and testing unintended memorization in neu- ral networks","venue":null,"work_id":"b63ef8b2-eadf-47b3-819c-e83e500fc69e","year":2019},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:2ab38d6d8c1b4befbb58a9680448c7ddd607d713c3eb74d8b9bc79bea384baa3","observation_id":"b9046128-0542-4384-8df3-3ac6aa95e2bd","resolution":{"observed_at":"2026-05-20T14:08:21.370802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Brown, Dawn Song, Úlfar Erlings- son, Alina Oprea, and Colin Raffel","venue":null,"work_id":"a992a13e-7ecf-40bd-b330-0d4f79900b61","year":2021},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:dc9d33a7aa6d6010dd5fe1fa6de2d1de6a97557fbedc3022e749f7279f55fedf","observation_id":"ee084fca-654e-419c-9fa7-06e76b9f215e","resolution":{"observed_at":"2026-05-20T14:08:21.372847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gan-leaks: A taxonomy of membership inference at- tacks against generative models","venue":null,"work_id":"46684c41-7cfb-4560-9789-2260c03ef11e","year":2020},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:96083d6f8e20f32c6ff6f96a401991ea97f8520a8464c790988fe3b186f1a676","observation_id":"44fdad9f-4020-4660-948f-8353761311eb","resolution":{"observed_at":"2026-05-20T14:08:21.357305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T19:52:52.616675Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality.See https://vicuna","venue":null,"work_id":"341430c8-5fd5-4fd7-9a2b-124ccb6947ab","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:8c62e2981c1b113b48dbd276a0e280e4254ca2d257066f9ffcf443d63ac7db77","observation_id":"2140d36b-aa01-45ea-b3c1-96c6a6156b37","resolution":{"observed_at":"2026-05-20T14:08:21.353476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Choquette-Choo, Florian Tramer, Nicholas Carlini, and Nicolas Papernot","venue":null,"work_id":"dd981c44-6e81-40bd-b863-a3348bca7251","year":1964},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:f0ea0a1ba84e9807257432b3edabc9da6125814383a616b0a7bcb266a5550260","observation_id":"fef601b6-1a3e-4ab3-b3e3-b50a66a21d2b","resolution":{"observed_at":"2026-05-20T14:08:21.326437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2305.06500","doi":"10.48550/arxiv.2305.06500","metadata_source":"pith","pith_arxiv_id":"2305.06500","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","venue":"cs.CV","work_id":"f3aac728-ded0-4e55-aa9e-4a1635d4313d","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2305.06500","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:5ffb80e267d15b81ca9a6a55b6d61c444d1eb9114036be888f81a0f0f333fe59","observation_id":"b37a7a27-3bac-43db-ab50-6fadc7c356f1","resolution":{"observed_at":"2026-05-20T14:08:20.897403Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-12T21:49:51.838916+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T21:49:51.838916+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1423","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T01:27:44.847366Z","title":"BERT : Pre-training of Deep Bidirectional Transformers for Language Understanding","venue":"Proceedings of the 2019 Conference of the North","work_id":"3e3c8ac8-b858-4b22-af32-393d98c883e0","year":2019},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:7f1affc659354afe89bffde7c182bc4c2738101fc62d22b6f0e63e98df3574db","observation_id":"a7ee9512-36e1-4874-b0b2-8b1dd9dcb094","resolution":{"observed_at":"2026-05-20T14:08:20.302705Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-17T19:51:02.335584+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T19:51:02.335584+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Do membership inference attacks work on large language models? InFirst Conference on Language Modeling","venue":null,"work_id":"62438f90-5cf7-4d94-b49c-748e03b0aa13","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:5c27a42611be52f4e27683dbce5a7cb19db3337723750ba6f42db91185a7f09d","observation_id":"458721fd-689f-4cd9-8791-9a1b3a6397dd","resolution":{"observed_at":"2026-05-20T14:08:21.361018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.06062","last_updated":"2024-11-26T03:19:15Z","snapshot_observed_at":"2026-07-06T16:45:43.474089Z","submitted_at":"2023-11-10T13:55:05Z","title":"Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration","version":4},"cited_work":{"arxiv_id":"2311.06062","doi":"10.48550/arxiv.2311.06062","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.06062","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Practical mem- bership inference attacks against fine-tuned large language models via self-prompt calibration","venue":null,"work_id":"935f756c-7271-446a-aa48-416bf6b98d65","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2311.06062","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:ed46fad2f4a8953dd6ef1f9b90c6beb11303c69ce1fe1c137fe416effdb18f50","observation_id":"6f51ca35-e414-4d2e-9ca6-e7a32df6f7c0","resolution":{"observed_at":"2026-05-20T14:08:20.925754Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Llama- adapter v2: Parameter-efficient visual instruction model","venue":null,"work_id":"7ae704a9-a147-44de-b6ab-5dba6bc1bf36","year":null},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:f39f5639a7227fc20027c5f93398d311d87ca3967724bb75489cc9d1706b0a2e","observation_id":"3326f827-9b4f-497c-9634-95f229ad0545","resolution":{"observed_at":"2026-05-20T14:08:21.359214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.15010","last_updated":"2023-04-28T17:59:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-28T17:59:25Z","title":"LLaMA-Adapter V2: Parameter-Efficient Visual Instruction Model","version":1},"cited_work":{"arxiv_id":"2304.15010","doi":"10.48550/arxiv.2304.15010","metadata_source":"pith","pith_arxiv_id":"2304.15010","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"LLaMA-Adapter V2: Parameter-Efficient Visual Instruction Model","venue":"cs.CV","work_id":"0fe2cfd8-d442-4ceb-b1a9-a465704f39b2","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2304.15010","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:229f319de63930026f68916745dad19aa454143062e6a4665e44df5ba4ce7621","observation_id":"f7dc437c-167a-401d-b5d6-554ec5c206a4","resolution":{"observed_at":"2026-05-20T14:08:20.922528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3389/frai.2024","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vision-language models for medical report generation and visual question answering: a review.Frontiers in Artificial Intelligence, 7, November 2024","venue":null,"work_id":"5c407c83-c825-4883-b013-f66932854579","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:af246cf05f409299a278eb7886b5d41fd4f49521e66c14a73f19b9aa0e76b69a","observation_id":"3cf1fd5b-f1c6-4b8d-8d62-9c701192d38c","resolution":{"observed_at":"2026-05-20T14:08:20.284763Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-05-23T13:52:43.930168+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T13:52:43.930168+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07663","last_updated":"2018-08-21T13:24:17Z","snapshot_observed_at":"2026-07-06T05:43:38.518500Z","submitted_at":"2017-05-22T11:05:06Z","title":"LOGAN: Membership Inference Attacks Against Generative Models","version":4},"cited_work":{"arxiv_id":"1705.07663","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.07663","snapshot_observed_at":"2026-07-03T04:37:37.055162Z","title":"LOGAN: Membership Inference Attacks Against Generative Models","venue":"cs.CR","work_id":"a5c0134c-7736-4075-95c9-fd11e05ea0e3","year":2017},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/1705.07663","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:22f923b2776b8a36a07872b90a82136dccfb98aadc3d4ae02b95a273b271a8a8","observation_id":"786fae30-2e03-436e-808e-9ad1b6f4a0c4","resolution":{"observed_at":"2026-05-20T14:08:20.928481Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dietterich","venue":null,"work_id":"50a5e597-4037-4793-9a21-cf1e8e637c21","year":2019},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:b8fb39d9378b63983d305521c3f273a634f3095255aa7e396e705393ca3d52ae","observation_id":"f302b152-8ffe-4fd8-b63b-9484e7f48e5d","resolution":{"observed_at":"2026-05-20T14:08:21.365079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Monte carlo and reconstruction membership in- ference attacks against generative models.Proceedings on Privacy Enhancing Technologies","venue":null,"work_id":"d3be92b1-c393-4a9e-a075-e40327a6a3f1","year":2019},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:60554c8daf4151b1e6da5aa148a543a5f125dd99794462341cab1638893c5769","observation_id":"0ebddce3-021c-4017-9d95-d366b6ef1c58","resolution":{"observed_at":"2026-05-20T14:08:21.368890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Defenses to membership inference attacks: A survey","venue":null,"work_id":"2e3fee0e-2913-42c2-97ce-fc84b053af09","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:abfb5522f62044f9fa4557da1b4a89c7a40d1ba8feede8992204ad1f3e99b51f","observation_id":"f2dfb342-0169-47fc-97c5-d6a79e596ee2","resolution":{"observed_at":"2026-05-20T14:08:21.374973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"M 4i: Multi-modal models member- ship inference","venue":null,"work_id":"8a6849d4-41a1-4e96-8f5d-d7084b67ad70","year":2022},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:2b4c8ca00e9c034a87a17f61754a75c9431d32def0bee20269de4f769a2c7054","observation_id":"8e4fda93-65b8-405a-9e03-100ea4d3e007","resolution":{"observed_at":"2026-05-20T14:08:21.349760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.09936","last_updated":"2023-12-18T04:33:17Z","snapshot_observed_at":"2026-07-06T16:07:57.164115Z","submitted_at":"2023-08-19T07:53:43Z","title":"BLIVA: A Simple Multimodal LLM for Better Handling of Text-Rich Visual Questions","version":3},"cited_work":{"arxiv_id":"2308.09936","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.09936","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bliva: A simple multimodal llm for better handling of text-rich visual questions","venue":null,"work_id":"d9a70d96-b1b1-477a-b706-5f54e44c0d5a","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2308.09936","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:454a37ae700cb79fc628bdfd623a18c0af763cb9e088d0af559c3d5dedd79ca4","observation_id":"0cafd12b-b189-443d-916a-e259bce524b2","resolution":{"observed_at":"2026-05-20T14:08:20.912443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Membership inference at- tacks against vision-language models","venue":null,"work_id":"520f17d7-1457-4432-821a-c97327b16abe","year":2025},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:174affef6f90dabe7a4b14517058a4b2ee503ddda0f24f5189fcbea73e7b4018","observation_id":"bd0e4cbd-b54b-4bce-a456-7a8b27ba4e98","resolution":{"observed_at":"2026-05-20T14:08:21.351549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling language-image pre- training via masking","venue":null,"work_id":"f580a1c3-2144-4986-ba6d-af35230760ed","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:b637e5ba2f0166ad233580b9706683227538b10867bd0ad4a6a0ab4a42c16aef","observation_id":"a266ab13-7d51-468e-bc02-4284aa43f67a","resolution":{"observed_at":"2026-05-20T14:08:21.376721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Membership inference attacks against large vision-language models","venue":null,"work_id":"cf598ce9-f127-4ee3-bee1-fcd59752a3b9","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:2b7b2cf8b3b61178bb217259289859222bf0ca15f2cf964c3cdf320308a968e3","observation_id":"b3c0534c-7c62-4f43-9360-6e0506a1b97d","resolution":{"observed_at":"2026-05-20T14:08:21.345734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0120.34845","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Membership leakage in label- only exposures","venue":null,"work_id":"ca164294-2da6-4be2-87c1-a93bc1f7b019","year":2021},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:b3ce57aa1f8b361ca95e9674541c5e55af698bd6a4b57f9611c1c597cb436db1","observation_id":"61670034-d039-4c95-beda-6519c2f38e61","resolution":{"observed_at":"2026-05-20T14:08:20.937609Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Visual instruction tuning","venue":null,"work_id":"de65b3dc-543e-4ff5-aa25-19418fb790e3","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:6b8ea1d06a131bd4d9d9ba0763e01fa2ce306fa50e19ed4d74d6989477ff1780","observation_id":"3be7ff62-a0ce-4993-9e45-d7d30d81f132","resolution":{"observed_at":"2026-05-20T14:08:21.347719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0120.348474","doi":"10.1145/3460120.3484749","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Encodermi: Membership inference against pre-trained encoders in contrastive learning","venue":null,"work_id":"c99dc0a1-ec62-4ff1-9e66-662b0d849ae8","year":2021},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:c826e9d5f4a0fb4da472e736ff5900eb6f69dd68e7e4219622b094a3ad2bf2e5","observation_id":"95524098-67ef-46c9-8404-76f270119633","resolution":{"observed_at":"2026-05-20T14:08:20.322281Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-05-23T13:52:44.392908+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T13:52:44.392908+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15050","last_updated":"2024-07-21T04:37:11Z","snapshot_observed_at":"2026-07-06T18:49:38.316515Z","submitted_at":"2024-07-21T04:37:11Z","title":"Arondight: Red Teaming Large Vision Language Models with Auto-generated Multi-modal Jailbreak Prompts","version":1},"cited_work":{"arxiv_id":"2407.15050","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.15050","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Arondight: Red teaming large vision language models with auto-generated multi-modal jail- break prompts","venue":null,"work_id":"e0a82823-df09-454c-bc77-032cbc15ed6f","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2407.15050","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:91160f2077355c96ead2dc89fb1b2d2b55f9acfebb2f8a68055da47789a82dcc","observation_id":"526436aa-b908-4efc-8404-0a816a15f809","resolution":{"observed_at":"2026-05-20T14:08:20.909416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14933","last_updated":"2022-08-31T16:02:26Z","snapshot_observed_at":"2026-07-06T13:47:32.907485Z","submitted_at":"2022-08-31T16:02:26Z","title":"Membership Inference Attacks by Exploiting Loss Trajectory","version":1},"cited_work":{"arxiv_id":"2208.14933","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2208.14933","snapshot_observed_at":"2026-06-29T08:43:15.845001Z","title":"Membership inference attacks by exploiting loss trajectory","venue":null,"work_id":"705ef9aa-e061-4c10-a666-86634867c579","year":2022},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2208.14933","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:bd1c2b88b4cc7b4713bd98f0c1e8cfeee31542dccc057893f9195fe7f875ac80","observation_id":"ef6bd352-f293-4a53-a21a-018bb1b20bcc","resolution":{"observed_at":"2026-05-20T14:08:20.915762Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.04889","last_updated":"2018-02-13T23:05:05Z","snapshot_observed_at":"2026-07-06T06:23:16.798440Z","submitted_at":"2018-02-13T23:05:05Z","title":"Understanding Membership Inferences on Well-Generalized Learning Models","version":1},"cited_work":{"arxiv_id":"1802.04889","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.04889","snapshot_observed_at":"2026-07-01T07:35:28.973169Z","title":"Understanding Membership Inferences on Well-Generalized Learning Models","venue":"cs.CR","work_id":"f61e4e76-70ad-4453-b0a7-13f4674ed34c","year":2018},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/1802.04889","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:c71d147b06440033240aa67ace914f6e8fc13be9d6db568f3aaedb0e17028ad3","observation_id":"103732a1-4172-4488-a25e-11a74f7ce765","resolution":{"observed_at":"2026-05-20T14:08:20.918725Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11384","last_updated":"2021-06-21T19:37:06Z","snapshot_observed_at":"2026-07-06T11:21:30.713389Z","submitted_at":"2021-06-21T19:37:06Z","title":"Membership Inference on Word Embedding and Beyond","version":1},"cited_work":{"arxiv_id":"2106.11384","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.11384","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Membership in- ference on word embedding and beyond","venue":null,"work_id":"5fd8f404-f43a-4e35-bb8f-3f635041ec41","year":2021},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2106.11384","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:004889df167f3d9eb94fed5401f198bfd4fd63823374b75c65e8799c1a7964b1","observation_id":"e018e779-7ce6-4261-ad5c-4e8199355ea9","resolution":{"observed_at":"2026-05-20T14:08:20.934285Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-acl.719","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T01:15:11.891270Z","title":"Membership inference attacks against language models via neighbourhood comparison","venue":null,"work_id":"f2325555-d273-4a48-b1c2-c2336f181dfe","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:575aaf8cc1819520a1df36ae3497abc0fbb92095c2cdfc9be49cb2c374a6f7b0","observation_id":"df0745d8-d577-4b00-8a21-644cce3b6883","resolution":{"observed_at":"2026-05-20T14:08:20.318725Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-05-23T13:52:44.829771+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T13:52:44.829771+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:30:06.904853Z","title":"Yifan Li, Yifan Du, Kun Zhou, Jinpeng Wang, Xin Zhao, and Ji-Rong Wen","venue":null,"work_id":"8122370e-553b-4d6f-b1a8-98e24c010366","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:f85f7175c60b3fc9172884d9ee87f576de7195b11f12c0c3eb081200406a4f3a","observation_id":"970635a4-61bc-473e-8b96-4a01ed01218f","resolution":{"observed_at":"2026-05-20T14:08:20.315247Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:49:28.723739+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:49:28.723739+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"An empirical analysis of memorization in fine-tuned autore- gressive language models","venue":null,"work_id":"eecf4cad-2430-431e-b7f6-d6419bdaad16","year":2022},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:040ae6c63eb3e3709e4660e05e511411efc1de4429bd59b7a995b32b904e9003","observation_id":"dfb02055-81e4-43b8-8975-c68a997bf222","resolution":{"observed_at":"2026-05-20T14:08:21.343990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Can llms keep a secret? testing privacy im- plications of language models via contextual integrity theory","venue":null,"work_id":"306efed5-e5dc-4837-91ac-808a94fbf583","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:ffab1536ca0d9ff4faff8535e38eb4ac8115954d32dd87fded8f194c2a08a511","observation_id":"5756e435-5de6-4fdf-916a-306a9bd557ef","resolution":{"observed_at":"2026-05-20T14:08:21.340246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-19809-0_30","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wagner, and Saining Xie","venue":null,"work_id":"16ace54e-5ac8-446e-85e3-296b4c4e8337","year":2022},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:2f1021e1c2e88b04de3849ea6432b3d97d0219ecc538b7b6f6c0dece218fdb4d","observation_id":"0d512d58-4c6a-489b-9d9a-5ff0e1f4e573","resolution":{"observed_at":"2026-05-20T14:08:20.295614Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-05-23T13:52:45.225747+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T13:52:45.225747+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:af4eeb308d807753b5e9dbbd0c851c7392e060f4737c6327637797438bf3dfce","observation_id":"4bc9215d-c6db-4067-a3af-2ffb04475a47","resolution":{"observed_at":"2026-05-20T14:08:20.906359Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13213","last_updated":"2023-08-16T22:38:55Z","snapshot_observed_at":"2026-07-06T15:45:47.517122Z","submitted_at":"2023-06-22T22:13:03Z","title":"Visual Adversarial Examples Jailbreak Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":"2306.13213","doi":"10.48550/arxiv.2306.13213","metadata_source":"arxiv_reference","pith_arxiv_id":"2306.13213","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Visual adversarial examples jailbreak aligned large language models","venue":null,"work_id":"6ecf4da5-e220-4e41-b036-2979b740e936","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2306.13213","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:8832e0db494824bfecad31bc50b70387559ef055636547b2bfa14093fc7f7d87","observation_id":"c5dcd8a0-1ecd-4bba-ae02-34177f862ff6","resolution":{"observed_at":"2026-05-20T14:08:20.903832Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning transferable vi- sual models from natural language supervision","venue":null,"work_id":"2a5be67a-ac13-4592-b24c-beac759397aa","year":2021},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:e9dfe916039fb56f07da185be26d8ab2bbef10504b1f300dcd7d4f740197141f","observation_id":"b19f89ff-ee8e-4f26-83c6-e7c1ed68c9f6","resolution":{"observed_at":"2026-05-20T14:08:21.342021Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3696410","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T01:40:21.001570Z","title":"Self- comparison for dataset-level membership inference in large (vision-)language model","venue":null,"work_id":"a38c3f83-a767-440c-863a-1194e119d5e0","year":2025},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:b6dc0bc5cf621b9e44d14c0f4d7bcb98b6e2b332c6fce985e782b7e09ef7d7d3","observation_id":"9fa88c90-b1cd-4b21-a4d4-291df90ff4d4","resolution":{"observed_at":"2026-05-20T14:08:20.292923Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-14T17:50:46.467323+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T17:50:46.467323+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"White-box vs black-box: Bayes optimal strategies for member- ship inference","venue":null,"work_id":"9656b6b4-41b1-45a2-ab31-35b88a04a91c","year":2019},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:9f9588d993960b04acb9b2cacc64b5c97641c80e391c51a8aba4849398ecfdda","observation_id":"35c8cb8b-ad56-429c-bbbf-410c8d7a855c","resolution":{"observed_at":"2026-05-20T14:08:21.355527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved zero-shot classification by adapting vlms with text descriptions","venue":null,"work_id":"6fafffeb-f5f4-4c82-9cbc-85a5f80eeaad","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:d8247661d8468b963d9cea6472d6a32db3142fa2cc356218f96e96c3d4899d13","observation_id":"a452e7e4-bb1e-49b5-a747-2556dc913824","resolution":{"observed_at":"2026-05-20T14:08:21.336071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ml- leaks: Model and data independent membership infer- ence attacks and defenses on machine learning models","venue":null,"work_id":"a984aeae-36f4-4236-97a4-f5f3613609b4","year":null},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:375f263c87f5575a23e20bbf2bf9c5dba3816d225593641f2a2ac4d8f09f9067","observation_id":"631e3293-b32a-496f-9adf-90d3c875ed29","resolution":{"observed_at":"2026-05-20T14:08:21.338297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01246","last_updated":"2018-12-14T19:39:43Z","snapshot_observed_at":"2026-07-06T06:42:52.124532Z","submitted_at":"2018-06-04T17:38:42Z","title":"ML-Leaks: Model and Data Independent Membership Inference Attacks and Defenses on Machine Learning Models","version":2},"cited_work":{"arxiv_id":"1806.01246","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.01246","snapshot_observed_at":"2026-07-04T10:59:46.015840Z","title":"ML-Leaks: Model and Data Independent Membership Inference Attacks and Defenses on Machine Learning Models","venue":"cs.CR","work_id":"56a6d2c5-db7d-4a05-8a0a-5703b5185ce8","year":2018},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/1806.01246","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:c802360544ca58820d43c24201e6d2e8c6e1ba53450dd831ccefd7734a239b61","observation_id":"f79edc86-0980-49ee-a8e9-07b72d121b87","resolution":{"observed_at":"2026-05-20T14:08:20.900418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Detecting pretraining data from large language models","venue":null,"work_id":"42d48755-5570-4ace-a94d-140b3134e3a0","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:0ec9613fc4c0b405ccbae6b46a8e6d53a5c3410eddb32a1921f2b86b160572ba","observation_id":"2fa9163d-028c-4556-9bd2-b7dce475596b","resolution":{"observed_at":"2026-05-20T14:08:21.334279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/sp.2017.41","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T14:36:17.426503Z","title":"author Stronati, M","venue":null,"work_id":"22f2fe57-62bc-4bcd-a747-31a85e46793d","year":2017},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:9d9380e7c3cc76aa5e909af010c168ee3e225bdee0ebcaecdbb632d943271b2e","observation_id":"efb3e29b-de05-4bd7-bc75-22eb5af910f5","resolution":{"observed_at":"2026-05-20T14:08:20.280402Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-05-23T13:52:45.982941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T13:52:45.982941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Informa- tion leakage in embedding models","venue":null,"work_id":"a57295b2-d6e4-45fe-a186-bf30ce3f10ca","year":2020},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:cba17c6d1cc4e903c79f14b3826636aaa1595bf35d4a169fa0e63a5fe1c4c0f2","observation_id":"10caf40b-a0a6-4cb1-bb01-23b157751c5a","resolution":{"observed_at":"2026-05-20T14:08:21.332523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.00021","doi":"10.1109/ase.2019.00021","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Proceedings of the 34th IEEE/ACM International Conference on Automated Software Engineering , pages =","venue":null,"work_id":"2a6489cc-5f17-49ed-a87f-6b630c6ec80c","year":2019},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:c8da133e41f89bbb3de57bb37336b351adef3211e99d19a59b1fcb0df7e38238","observation_id":"6f2fc61e-0799-46b0-9dbf-8b2c61580749","resolution":{"observed_at":"2026-05-20T14:08:20.306923Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2019.293512","doi":"10.1109/tcsvt.2019.2935128","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Data augmentation using random image crop- ping and patching for deep cnns.IEEE Trans","venue":null,"work_id":"8fbe923c-37ba-4002-8576-f1a6197ad9f3","year":2020},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:dc980567185865e2b14aeb6accce7d93f283dba0a495df6a506d52165e41f779","observation_id":"416b4107-7ed2-494c-9e98-6d27fcd5480c","resolution":{"observed_at":"2026-05-20T14:08:20.276066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-05-23T13:52:46.837436+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T13:52:46.837436+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":"2302.13971","doi":"10.48550/arxiv.2302.13971","metadata_source":"pith","pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-07-11T03:47:48.508181Z","title":"LLaMA: Open and Efficient Foundation Language Models","venue":"cs.CL","work_id":"c018fc23-6f3f-4035-9d02-28a2173b2b9d","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:3f9048c1c9a2ff06c9cd30dce855674b882c900b7fd445750be650bd092dc5df","observation_id":"83c6b20c-67cc-453e-a362-ba32ad6e10bc","resolution":{"observed_at":"2026-05-20T14:08:20.893951Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:22:41.000069+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:22:41.000069+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2734.2025","doi":"10.1109/cvpr52734.2025","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Freeman, Frédo Durand, Eli Shechtman, and Xun Huang","venue":null,"work_id":"d0e5199d-8907-47b1-905a-07ab8b623a4c","year":2025},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:8602158bc8a75994d521e68e6923b934bc3369821ed53a78b6d3fdba7eae2330","observation_id":"967c2bf5-c7c9-4ddb-bc9b-4e2d9dc75b2c","resolution":{"observed_at":"2026-05-20T14:08:20.312150Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:50:06.316117+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:50:06.316117+00:00","source":"openalex_status_cache"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03079","last_updated":"2024-02-04T08:23:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-06T13:04:39Z","title":"CogVLM: Visual Expert for Pretrained Language Models","version":2},"cited_work":{"arxiv_id":"2311.03079","doi":"10.48550/arxiv.2311.03079","metadata_source":"pith","pith_arxiv_id":"2311.03079","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"CogVLM: Visual Expert for Pretrained Language Models","venue":"cs.CV","work_id":"0d81fb99-dae6-46d2-8bed-c01dcbd7d7cf","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2311.03079","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:de90d0fe8048db5289793e1e2050e1d2cb29df4caff9c0e283f50ec1bd893f60","observation_id":"4fca02a6-05f8-4a03-8a68-c2c12d842dfe","resolution":{"observed_at":"2026-05-20T14:08:20.888325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"On the importance of diffi- culty calibration in membership inference attacks","venue":null,"work_id":"18556342-c1b0-4e7a-9c4f-eb13bc3405b6","year":2022},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:3ee8a4dc477cc8cec095807115ebca4170f7cbd35a68fae42094f31267d90827","observation_id":"bc0ae459-9571-4f81-8216-49004f77ed1d","resolution":{"observed_at":"2026-05-20T14:08:21.328323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6c2bd854-6857-4d21-afa1-3b4fc8b4f163","year":2020},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:c4a3d5c4e138695331641283618ce1213381083cb8384c3d98e568554cbd77ec","observation_id":"ce40e591-c264-47d0-9f20-2eeae195db09","resolution":{"observed_at":"2026-05-20T14:08:21.330636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06659","last_updated":"2024-10-14T16:17:34Z","snapshot_observed_at":"2026-07-06T17:28:10.554625Z","submitted_at":"2024-02-05T18:55:53Z","title":"Shadowcast: Stealthy Data Poisoning Attacks Against Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2402.06659","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.06659","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shadowcast: Stealthy data poisoning attacks against vision-language models","venue":null,"work_id":"23ea81f1-f592-43d1-b664-432e6a8db132","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2402.06659","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:32baccd964dc9652d5790bd21419aa94de1594e9129819512515e6b6ca3463c8","observation_id":"86063288-5c08-41d7-9ffc-2b9f23ef74f0","resolution":{"observed_at":"2026-05-20T14:08:20.891338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Privacy risk in machine learning: Analyz- ing the connection to overfitting","venue":null,"work_id":"c3cda2aa-ef32-4c86-a3f6-cfda05505e63","year":2018},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:eabb4b43d9512b4b2bcbcfc85549f14e335d2402cd4597414d0358a38dd146dd","observation_id":"6d5f088d-89c1-4588-8ddd-5eb037f38e90","resolution":{"observed_at":"2026-05-20T14:08:21.322657Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yeats, Yang Ouyang, Martin Kuo, Jianyi Zhang, Hao (Frank) Yang, and Hai Li","venue":null,"work_id":"6f314ea1-75dd-4fde-870e-7b97d9256d2f","year":2025},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:8c3b2e332e24af5633d4dafd04ed62ac2d005516379827136b8400090e377afa","observation_id":"f5bd13a2-8b44-4b41-a6c5-e5972c68b0c2","resolution":{"observed_at":"2026-05-20T14:08:21.324456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL: https://openreview","venue":null,"work_id":"b33c17e0-47e0-4ca0-9325-750b66a5fc38","year":2025},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:6c5f8f344b976071b9f5c43c1965b68d75b5d3a0bab1f87a2024952861c773a5","observation_id":"252a987c-6474-4500-9386-b8dd1486ccef","resolution":{"observed_at":"2026-05-20T14:08:21.320510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":"2303.18223","doi":"10.18653/v1/d16-1080","metadata_source":"pith","pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"A Survey of Large Language Models","venue":"cs.CL","work_id":"de1b42b5-4a0a-4b1f-8c78-1f7fe21be6c9","year":2023},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:9fcaea88116b4478e42c167cf464a613059ee754a1db772c82df7f9a1bb42f2d","observation_id":"a7ca5b6c-4547-4fe3-8f44-af9831418c19","resolution":{"observed_at":"2026-05-20T14:08:20.940492Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0031.0000","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Minigpt-4: Enhancing vision- language understanding with advanced large language 19 models","venue":null,"work_id":"e3671284-1ec6-4880-858d-a1bab34af6fd","year":2024},"citing_paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-20T14:07:56.386933Z"},"links":{"citing_paper":"/paper/2605.17341"},"observation_digest":"sha256:c118b117101d94e344f0f3a17af2c10fd9b10f797e95d366e6591c78922dfda2","observation_id":"a82a8851-ae79-40b3-8a7b-1f90617ee495","resolution":{"observed_at":"2026-05-20T14:08:20.885170Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-07-22T06:31:00.163083+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.17341","last_updated":"2026-05-17T09:21:11Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:28:21.395050Z","submitted_at":"2026-05-17T09:21:11Z","title":"Single-Sample Black-Box Membership Inference Attack against Vision-Language Models via Cross-modal Semantic Alignment"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":1,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":0,"verified_exact":25,"verified_fuzzy":31},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-07-22T06:31:00.163083+00:00","source":"crossref"},{"observed_at":"2026-07-22T06:30:55.410749+00:00","source":"retraction_watch"}],"thesis":"As of 22 July 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2605.17341."}