{"as_of":"2026-08-07T17:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:41b4d2b7ccc3bdf84c3978db0024cafe195f487654138ed599102bf2f80f51d0","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:42:31.204167Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01020/citation-record","integrity":"/paper/2608.01020/integrity","json":"/paper/2608.01020/citation-record.json","paper":"/paper/2608.01020"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:36.414689Z","title":"Unveiling the vulnerability of private fine-tuning in split-based frameworks for large language models: A bidirectionally enhanced attack,","venue":null,"work_id":"a58d0368-cc71-45ce-8a30-e22422b78693","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.115305Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:a5bd501b7c4dcc345ad9860e6f4c6553247699612910276b2723a967cfce2301","observation_id":"900cffbb-e600-405b-8aad-74454c91c20c","resolution":{"observed_at":"2026-08-06T00:42:36.535555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:28.176827Z","title":"Language models are injective and hence invertible,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.176827Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:a52dbf67abc085604df74ec08c3733c2d0c222eb72b709038addaec5a8486434","observation_id":"84e0f646-4a1b-49e5-98eb-508f98222372","resolution":{"observed_at":"2026-08-06T00:42:28.176827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.06571","last_updated":"2026-05-08T15:19:37Z","snapshot_observed_at":"2026-07-06T22:35:18.393401Z","submitted_at":"2025-11-09T23:18:36Z","title":"Rep2Text: Decoding Full Text from a Single LLM Token Representation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.06571","snapshot_observed_at":"2026-08-06T00:42:28.276638Z","title":"Rep2text: Decoding full text from a single llm token representation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.276638Z"},"links":{"cited_paper":"/paper/2511.06571","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:7b2294c11fcf60cc11a9e7aded49530bbe567db7a59490c51f931b8670c7b1c8","observation_id":"fa2d9e2b-9f56-47c0-b295-9c83ff0f1bee","resolution":{"observed_at":"2026-08-06T00:42:28.276638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:36.095795Z","title":"Inverting visual representations with convolutional networks,","venue":null,"work_id":"de98b59c-89e6-47ef-bdee-99fd4385e1ee","year":2016},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.385825Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:476cb4db419c0b2f7e5137b8882e1dc46b20ad19bc0deb0914b950d669254ee6","observation_id":"b902e04b-11a7-4ddd-bc4e-ec9aafd3e5dd","resolution":{"observed_at":"2026-08-06T00:42:36.267438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06534","last_updated":"2025-08-13T18:10:14Z","snapshot_observed_at":"2026-07-06T20:03:56.309640Z","submitted_at":"2024-12-09T14:43:06Z","title":"Understanding Transformer-based Vision Models through Inversion","version":4},"cited_work":{"arxiv_id":"2412.06534","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06534","snapshot_observed_at":"2026-08-06T00:42:31.527823Z","title":"Understanding Transformer-based Vision Models through Inversion","venue":"cs.CV","work_id":"79e1827f-0563-4aff-9a9b-a76c527f7a94","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.469693Z"},"links":{"cited_paper":"/paper/2412.06534","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:7257b6e654c10177183c792c7ce3714d528f1c5352b4b70545dec333bff5b2ef","observation_id":"2667750d-a3e5-4318-8149-30205dfe0dc6","resolution":{"observed_at":"2026-08-06T00:42:31.570046Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:35.815990Z","title":"Sparse model inversion: efficient inversion of vision transformers for data-free applications,","venue":null,"work_id":"533c02ad-10ba-48f5-99b5-cf4ca2b75425","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.556824Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:41d52bfad825f902953ac0eade0ae837eceba3dae0302147d14c32bf615204e1","observation_id":"735f549d-dd75-458b-92c0-62d145269e18","resolution":{"observed_at":"2026-08-06T00:42:35.926981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:35.634997Z","title":"A survey of attacks on large vi- sion–language models: Resources, advances, and future trends,","venue":null,"work_id":"d5813c3a-62ce-45aa-95c6-7d23cac8282d","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.659787Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:f4a2f0f4a69fcfb2c5bf96233028a3ddd26e69c9ecba409a0e4ee50ca8d3016d","observation_id":"f6e854a5-7f5f-492c-8469-acbc6172cb43","resolution":{"observed_at":"2026-08-06T00:42:35.737572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:35.359265Z","title":"Lvlm-ehub: A comprehensive evalu- ation benchmark for large vision-language models,","venue":null,"work_id":"c7fbe40f-ba63-4ffe-bc6e-2cc1a07b0daa","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.766983Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:879c917a70247e313fc5400aae92552371e222839d3e3d1180be03204237feff","observation_id":"1a3f8058-e0bf-47b5-bba6-2050b962b7aa","resolution":{"observed_at":"2026-08-06T00:42:35.497375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:35.031576Z","title":"A survey of state of the art large vision language models: Benchmark evaluations and challenges,","venue":null,"work_id":"a15bd8ea-cde1-46f8-a355-83e7adbf5003","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.883500Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:7429ca7c792f223742205b4654049ead2dfae2058885ddff5410601826a6e87c","observation_id":"80177e8a-cfee-432f-a43c-0cc6e4de778a","resolution":{"observed_at":"2026-08-06T00:42:35.130269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:28.960540Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:28.960540Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:76faf32ae7434c6162e48a99a9caa39aba77c0b5d60fe48157b840d4f948fb02","observation_id":"d852de2e-7fd3-4fff-8250-148d2e8d8edc","resolution":{"observed_at":"2026-08-06T00:42:28.960540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.843596Z","title":"Visual instruction tuning,","venue":null,"work_id":"6cae105a-ac55-4b63-8c07-95b2ab833a55","year":2023},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.069667Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:d6976c858739021847ffe0e8b4560bc6e38d7282b45a2af05bb86a89bb474da5","observation_id":"08f9f9e3-b82a-4755-b98d-3d9ddfa4c970","resolution":{"observed_at":"2026-08-06T00:42:34.913502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.596435Z","title":"Improved baselines with visual instruction tuning,","venue":null,"work_id":"9f1e574e-7051-4431-86db-6130e4f5c6b3","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.168884Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:73ce0a9533822d3ac1845170fc4b6280d79f33e4b52fb7a9a5b92a7c42aa5b1d","observation_id":"efda392e-900c-412b-9fdd-6bd72e86a1a9","resolution":{"observed_at":"2026-08-06T00:42:34.738232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.322858Z","title":"Llava-next: A strong zero- shot video understanding model,","venue":null,"work_id":"71917ca0-f6ff-4693-89ba-e23c2fb2bf6d","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.265624Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:3ccf0642620bd75c459ba65c1b8e325461def441ce2b5687eb15331c3a279eff","observation_id":"d61176b1-410f-430c-9c6c-7cb4c513f253","resolution":{"observed_at":"2026-08-06T00:42:34.428770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T00:42:29.343041Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.343041Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:86970e8c37ba755285c0ce37e567fbe2b59a3a8dbbba3238c7f827a4f5a9d0cb","observation_id":"f96fe334-1915-4f38-98d8-dbfb38687328","resolution":{"observed_at":"2026-08-06T00:42:29.343041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T00:42:29.392607Z","title":"Qwen2.5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.392607Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:a8311c3af86cab21e93ee23837b91d12c8625b2c661825277c31df9faef08fc8","observation_id":"83e09ee6-4ad6-406a-ac70-bf67506bbb05","resolution":{"observed_at":"2026-08-06T00:42:29.392607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-06T00:42:29.481695Z","title":"Qwen3-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.481695Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:304aa8b2a799363c2d49b947be6624991002730cfd73b0304abfa3de902ea7f6","observation_id":"72117b07-a724-4c12-9674-f85027c352b1","resolution":{"observed_at":"2026-08-06T00:42:29.481695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.222582Z","title":"Neurosurgeon: Collaborative intelligence between the cloud and mobile edge,","venue":null,"work_id":"45a2e5d8-9aa9-489f-bfbd-7946293b8a5e","year":2017},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.613466Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:1b6b908b1ed1dccaf81caf004e3a0088f1850d6e9e68e68ffce9f66cc724063e","observation_id":"34f7ed36-1561-4f5d-b985-142bdbd60095","resolution":{"observed_at":"2026-08-06T00:42:34.298730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10759","last_updated":"2024-10-16T16:31:37Z","snapshot_observed_at":"2026-07-06T19:33:12.610676Z","submitted_at":"2024-10-14T17:38:41Z","title":"SplitLLM: Collaborative Inference of LLMs for Model Placement and Throughput Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10759","snapshot_observed_at":"2026-08-06T00:42:29.718307Z","title":"Splitllm: Collaborative infer- ence of llms for model placement and throughput optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.718307Z"},"links":{"cited_paper":"/paper/2410.10759","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:c709b7d71b59392e2dc3730d017e06cf48c200f4c20028c9bd3d86a64782b31c","observation_id":"81076eba-15a5-423d-8b3b-8578df105b91","resolution":{"observed_at":"2026-08-06T00:42:29.718307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:34.074037Z","title":"Model-distributed inference for large language models at the edge,","venue":null,"work_id":"95fe512c-085a-4c3d-ab46-2220e4bb1b2b","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.816891Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:1abdd858cb9af2c8eac4b82e2d04180f4fa3791b5acb4773625e59bd4d5fe13b","observation_id":"264f84ab-b502-4368-af15-4e76d698dbef","resolution":{"observed_at":"2026-08-06T00:42:34.154313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.945344Z","title":"Petals: Collaborative inference and fine-tuning of large models,","venue":null,"work_id":"328895fc-265c-45ac-a050-ef5a5e76480b","year":2023},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.924310Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:78add82db1604a16e1c28eec850d9d8c9ba7e54de8fd02dc2b178f63c06b984e","observation_id":"14a26aed-54c7-4df0-b0df-ff009e8dce7d","resolution":{"observed_at":"2026-08-06T00:42:34.005500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.798857Z","title":"Understanding deep image represen- tations by inverting them,","venue":null,"work_id":"a6080884-b4a2-4d57-9643-8e691a06f091","year":2015},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:29.977794Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:e5965d599b395704723d2e8dc439b305f64bc57df776201243ea6f7fe9f2f02b","observation_id":"e051eccf-6d97-4355-9dea-60e8d4638375","resolution":{"observed_at":"2026-08-06T00:42:33.849026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.677355Z","title":"The secret revealer: Generative model- inversion attacks against deep neural networks,","venue":null,"work_id":"d681b85f-4702-433f-b236-1e84a8724178","year":2020},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.041570Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:23669a635a66d0af5e1b3c2fd945148fbd3630195d1b521477188505aadd00b0","observation_id":"f17ad10a-5f44-445b-83b9-206937aab9e8","resolution":{"observed_at":"2026-08-06T00:42:33.737298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.529290Z","title":"FaceObfuscator: Defending deep learning-based privacy attacks with gradient descent-resistant features in face recognition,","venue":null,"work_id":"fd5b9cf7-e3c6-4b08-a559-141831382557","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.122982Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:69be5b41dde1b16822a46cdc4eff45be95eb9be3e5136d0034b0b9d223c06530","observation_id":"4f8f7999-204e-4d7b-bb6d-d593d76a2b0d","resolution":{"observed_at":"2026-08-06T00:42:33.593905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.338840Z","title":"Gradvit: Gradient inversion of vision transformers,","venue":null,"work_id":"f0161397-1e24-4c28-bb87-0ca3f8abe521","year":2022},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.203069Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:e854ce14f0a8a9f2b4b4d69997e655f9d3a2f2ade6f73f9744a6258712efc075","observation_id":"ea2cbac1-d24d-4940-a0b9-b488dd64b767","resolution":{"observed_at":"2026-08-06T00:42:33.398543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02580","last_updated":"2024-03-05T01:32:29Z","snapshot_observed_at":"2026-07-06T17:39:37.064843Z","submitted_at":"2024-03-05T01:32:29Z","title":"What do we learn from inverting CLIP models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02580","snapshot_observed_at":"2026-08-06T00:42:30.330083Z","title":"What do we learn from inverting clip models?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.330083Z"},"links":{"cited_paper":"/paper/2403.02580","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:5b11ce381df195c44bf2fc29d69592235b05235d82b726b9ac67eb711e972c38","observation_id":"20ecf680-2b33-4ed6-9ba5-58b2065abaf7","resolution":{"observed_at":"2026-08-06T00:42:30.330083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.182280Z","title":"Information leakage in embedding models,","venue":null,"work_id":"115df285-89e5-4053-a710-50f583e6e98e","year":2020},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.380183Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:e8049a608154382c7718128de28dcffd84bf8f5c4d26b452834f6ee40ef4c708","observation_id":"3eb97dac-c959-47a5-8b05-88248754acc9","resolution":{"observed_at":"2026-08-06T00:42:33.292469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:33.025571Z","title":"Privacy risks of general-purpose language models,","venue":null,"work_id":"e4be4ad1-65aa-4edc-b329-68d36fc1ef98","year":2020},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.439543Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:a21581fccfd6b0d3d4f1b9834d87c0fa5f90e3c7ada7315800e88936e744f9e6","observation_id":"0ec4ea90-b060-4dbd-8085-093a9ad4b3da","resolution":{"observed_at":"2026-08-06T00:42:33.100376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.852271Z","title":"Extracting prompts by inverting llm outputs,","venue":null,"work_id":"ee8ab25e-e402-42cd-80ab-40174b342417","year":2024},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.499767Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:579ff18c4bb9a89a73b37faa7bf10e321943b270a36a60d35a147fd56bf79169","observation_id":"291d7993-2487-4aa9-a383-677cda72c9ea","resolution":{"observed_at":"2026-08-06T00:42:32.915084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.657504Z","title":"Text embeddings reveal (almost) as much as text,","venue":null,"work_id":"6f63d783-9400-44a3-a72a-0aece1b01894","year":2023},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.556939Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:435e4c1d2c83c650e944f03007f89a693a91543dc1fc078751d752f69a4890ea","observation_id":"89fd303f-6e19-4ca6-a77b-323749c9b2a1","resolution":{"observed_at":"2026-08-06T00:42:32.752216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.483513Z","title":"Prompt inversion attack against collab- orative inference of large language models,","venue":null,"work_id":"a1168828-2494-4b88-aa94-e8415bf4e376","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.635937Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:67952d65668017028371ea076f832af067e549d8f223fd2cbf0811dafc9ce998","observation_id":"f6c9f2aa-49af-4689-81c4-9b4c8be29a52","resolution":{"observed_at":"2026-08-06T00:42:32.559352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.369990Z","title":"Caprecover: A cross-modality feature inversion attack framework on vision language models,","venue":null,"work_id":"cedddc47-9591-4abb-8f1f-92f78bd54f33","year":2025},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.690712Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:9b8652da30e2f2bb05b38ab7dcb2d899dc857e6794ef116d78b11deccae43260","observation_id":"e045d0aa-a0cc-4a1e-b911-e970037bd5e1","resolution":{"observed_at":"2026-08-06T00:42:32.428153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.232750Z","title":"Do vision-language models leak what they learn? adaptive token-weighted model inversion attacks,","venue":null,"work_id":"aa273965-171a-456d-bb96-2fd24c9a0ab5","year":null},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.750157Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:e7176fe6a9ec114ce90ba0f2157a0579a0a544e58503f622ffb9648c1a9f364d","observation_id":"95269d61-675c-4250-99d6-00b83a49a574","resolution":{"observed_at":"2026-08-06T00:42:32.306493Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:32.091364Z","title":"Making the v in vqa matter: Elevating the role of image understanding in visual question answering,","venue":null,"work_id":"30ee1a04-77ac-44b6-b2dc-d84f19d1b582","year":2017},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.907925Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:9d29743eb5a2ec6a1ec6f049801f6ae3bacd176037cd2be81e97dd0dabc7e72a","observation_id":"169469fb-ad97-4231-bd1b-02763d6a8e33","resolution":{"observed_at":"2026-08-06T00:42:32.160213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.954830Z","title":"Deep learning face attributes in the wild,","venue":null,"work_id":"f530381a-e7f3-4084-bb31-ed667b2f4af6","year":2015},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.966920Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:05ff0f4c74998aa37017d0021de6b3485bea27c09b5f45c728c1f4e10fc1d893","observation_id":"bd800934-0492-401a-ae36-8c78b7a56164","resolution":{"observed_at":"2026-08-06T00:42:32.001261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.024444Z","title":"Automated flower classification over a large number of classes,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:31.024444Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:be8dbf5d4de97d0ceea1f88bc01b5c8ac8693daf55cc13730966bacc21d79135","observation_id":"9081f5d2-4e96-4632-a8bf-25b63ef091da","resolution":{"observed_at":"2026-08-06T00:42:31.024444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05355","last_updated":"2018-12-18T10:58:20Z","snapshot_observed_at":"2026-07-06T06:28:16.475418Z","submitted_at":"2018-03-14T15:30:37Z","title":"FEVER: a large-scale dataset for Fact Extraction and VERification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05355","snapshot_observed_at":"2026-08-06T00:42:31.081302Z","title":"Fever: a large- scale dataset for fact extraction and verification,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:31.081302Z"},"links":{"cited_paper":"/paper/1803.05355","citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:ddf2c29e2cf56ee4573122fd2c918dbbb2da64a32adc28f095e1a0826ae99e06","observation_id":"621d91d1-d45a-44cb-bec8-c858179f1986","resolution":{"observed_at":"2026-08-06T00:42:31.081302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.838693Z","title":"Ms marco: A human- generated machine reading comprehension dataset,","venue":null,"work_id":"e33a2717-bdb3-44fc-bcc7-5965b70c940a","year":2016},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:31.126981Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:e9552ff0946ae2f103ba851929fe6656a2329e87217e5a1a7cd28e96283ddee8","observation_id":"3a3a0d31-2469-4134-b019-4dcc80db34ee","resolution":{"observed_at":"2026-08-06T00:42:31.903031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.738443Z","title":"Anycost gans for interactive image synthesis and editing,","venue":null,"work_id":"c8646915-33aa-4085-badc-5d0fce8c0d67","year":2021},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:31.204167Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:05df5d3a78c77c4f531e31f0d1947904dc7b92adf702c7ac5fe91c2903932a9c","observation_id":"a2dfb1fd-8599-4409-90cf-c470c465470f","resolution":{"observed_at":"2026-08-06T00:42:31.776581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.04097","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:42:31.374340Z","title":"Available: https://arxiv.org/abs/2508.04097","venue":null,"work_id":"ac844d52-e79e-4f8a-8f0c-ead565cc2b92","year":null},"citing_paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-06T00:42:30.829012Z"},"links":{"citing_paper":"/paper/2608.01020"},"observation_digest":"sha256:705691cb642fe209578f54b0c107f45551d11eb82267f5660dc94198bf863d66","observation_id":"affabe7d-c9bf-431e-8f79-51d24993ea9f","resolution":{"observed_at":"2026-08-06T00:42:31.426712Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.01020","last_updated":"2026-08-02T05:56:23Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-06T23:25:18.794464Z","submitted_at":"2026-08-02T05:56:23Z","title":"Inverting the Hidden: Unveiling Multimodal Privacy Leakage in Collaborative LVLM Inference"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":2,"verified_fuzzy":27},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 0 inbound Pith citation observations for arXiv:2608.01020."}