{"as_of":"2026-08-19T15:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:75693ae44fe53851375ef4e3a1f7eb86e0c39072c5d1b760285ca91cbd92c6fd","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:10:23.129223Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:36:30.807712Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-10T05:30:23.456663Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-10T05:30:23.456663Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"cited_work":{"arxiv_id":"2505.05318","doi":"10.48550/arxiv.2505.05318","metadata_source":"pith","pith_arxiv_id":"2505.05318","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","venue":"cs.CV","work_id":"05385dbe-eb74-4ae0-9f73-6a9846e1769d","year":2025},"citing_paper":{"arxiv_id":"2507.13041","last_updated":"2025-07-17T12:10:34Z","snapshot_observed_at":"2026-08-18T12:23:01.083496Z","submitted_at":"2025-07-17T12:10:34Z","title":"What Can Robots Teach Us About Trust and Reliance? An interdisciplinary dialogue between Social Sciences and Social Robotics","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T16:36:30.807712Z"},"links":{"cited_paper":"/paper/2505.05318","citing_paper":"/paper/2507.13041"},"observation_digest":"sha256:57daa3841a5727e078e16f88a9eb15b30cdbbb5bf0134ed133c6d74ea9ceaca2","observation_id":"f8a95d83-5438-447a-9a55-749d0dc0e551","resolution":{"observed_at":"2026-08-06T16:36:30.980083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.05318/citation-record","integrity":"/paper/2505.05318/integrity","json":"/paper/2505.05318/citation-record.json","paper":"/paper/2505.05318"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.633255Z","title":null,"venue":null,"work_id":"c94937c0-8f2f-4ae5-b646-651f5f5f3192","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.657329Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:be5176cf27541be6889625c622175eb8186d76afe5bd6f7548dc6e48caa6e49b","observation_id":"e37422af-b564-4021-ba60-9480e1dc99a7","resolution":{"observed_at":"2026-08-15T23:10:24.638303Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.722647Z","title":"Calegari, G","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.722647Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:05ccf753d3bafe3a6c6b6b47aaede472f9f1467d3637eb1685c6e695e4f01c1c","observation_id":"d81ce492-92db-4eae-b67d-a63c97f75da5","resolution":{"observed_at":"2026-08-15T23:10:22.722647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.777932Z","title":"Chander, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.777932Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:dcf1d0a642f22cd0c0902edf8261ef9e67288072ef4efaefa569974f41e2b355","observation_id":"39839f80-9d1c-4e57-b41d-ec2397f521c0","resolution":{"observed_at":"2026-08-15T23:10:22.777932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.618399Z","title":null,"venue":null,"work_id":"ed66ece6-28e0-405c-8e2f-a8bb8ddcc181","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.803665Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:1cad2eda8493ff36e71fdb8ff8116a760576861be755704ad200d6320f2c05ff","observation_id":"9c71d3b2-7e5a-4fe0-b7bb-a93def2b0217","resolution":{"observed_at":"2026-08-15T23:10:24.623282Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.603278Z","title":null,"venue":null,"work_id":"086ac7b0-0402-45a7-a016-db035e265bf6","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.812832Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:951c144df2f8cdb225f2eacde23e7f0217fb9154c2bff559a8d5b08de00a4136","observation_id":"1a6efc6e-e91f-45b9-ac11-0837289fd60d","resolution":{"observed_at":"2026-08-15T23:10:24.608026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.587465Z","title":"Chen, D.-Z","venue":null,"work_id":"a061d66d-0954-47b9-b94a-656e9e4b46f8","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.817570Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:75a54cfb2556f5187cb0b7d66ed8df46544551ffac8c6ea041db8521c45fdc05","observation_id":"918119e2-5c6a-4421-a26a-77d4907347bb","resolution":{"observed_at":"2026-08-15T23:10:24.592497Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19392","last_updated":"2024-07-02T15:30:03Z","snapshot_observed_at":"2026-08-18T12:56:36.980908Z","submitted_at":"2024-06-27T17:59:45Z","title":"ReXTime: A Benchmark Suite for Reasoning-Across-Time in Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19392","snapshot_observed_at":"2026-08-15T23:10:22.822575Z","title":"Chen, Y .-C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.822575Z"},"links":{"cited_paper":"/paper/2406.19392","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:30ac8f2b12d1513e018111f9d309d7e229857d957a371c8a13cbd96801185d7a","observation_id":"69e432b5-9dc4-4b40-9d75-ad6c6408dd23","resolution":{"observed_at":"2026-08-15T23:10:22.822575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.572202Z","title":null,"venue":null,"work_id":"dacbaa12-68b2-40b0-888f-05f28d06ce42","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.828352Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:31d19093aa079316de7408471b2074b23898d4a6087e72a4201e495d101d5eca","observation_id":"6c2d1bf2-4903-4f55-b9d7-1c2cae76530c","resolution":{"observed_at":"2026-08-15T23:10:24.576864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.556738Z","title":"Cheng, H","venue":null,"work_id":"a0188840-f1e1-48a7-a1f7-5aefe13c7bb9","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.834655Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:4673bcd8ced4fd52487d4083694d369f237fa38cdbb712003b086fd30c403c61","observation_id":"3d09b69a-39d6-43d7-b4e5-a1062b7b2a20","resolution":{"observed_at":"2026-08-15T23:10:24.561302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.541930Z","title":null,"venue":null,"work_id":"7b52327a-cfad-45f6-8721-ec5bf51a388d","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.839818Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:5fe49765b7866188b1aae1afde57c3acc23059bb452dd2213418f774363c93e3","observation_id":"76744e26-9771-4ae2-8919-1f0777ddb6c7","resolution":{"observed_at":"2026-08-15T23:10:24.546536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.527420Z","title":"Commission","venue":null,"work_id":"637f136e-5c86-4d00-a19f-6fd19c4def51","year":2019},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.844759Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:68835a9fa57d9763c7658f3ce3c10bce0bc5d01426a85287ba389a7266a26df7","observation_id":"2550e940-43ac-4906-85dc-d43103f0b52c","resolution":{"observed_at":"2026-08-15T23:10:24.531896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.511688Z","title":"Commission","venue":null,"work_id":"eaebab76-94a7-4fd7-8704-403c1377790a","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.849952Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:86492683396d543a5d5f6f1fb5d93712117765f57fdb6cdd907610eefa9dbb91","observation_id":"8844ff78-777c-4b55-a5bf-5fa40c257c34","resolution":{"observed_at":"2026-08-15T23:10:24.517258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.496568Z","title":null,"venue":null,"work_id":"d05feb06-ddcd-4651-9d42-d8d2a6b663ad","year":null},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.855209Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:54135dfd662f5f12850d7940769379a117fd3e44bf209a97fa233b5a94afe24d","observation_id":"5134c927-b37d-462f-b0e2-c24c466c23ea","resolution":{"observed_at":"2026-08-15T23:10:24.501280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01433","last_updated":"2024-07-18T20:58:03Z","snapshot_observed_at":"2026-08-16T13:32:54.528832Z","submitted_at":"2024-07-18T20:58:03Z","title":"Evaluating and Enhancing Trustworthiness of LLMs in Perception Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01433","snapshot_observed_at":"2026-08-15T23:10:22.865169Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.865169Z"},"links":{"cited_paper":"/paper/2408.01433","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:76bc88fad5897484274fddb74609589dc9565844f7250ed60bfc2e822dc460aa","observation_id":"ba11dce1-9271-42d5-a431-e751358f3203","resolution":{"observed_at":"2026-08-15T23:10:22.865169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.869904Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.869904Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:adc660e070c6f794b6c441058b52571a3424c0b95290aad1d122a376177cf18c","observation_id":"a41bc8e1-62c5-4a74-aa8b-b9d6d514ca35","resolution":{"observed_at":"2026-08-15T23:10:22.869904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.874512Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.874512Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:695cbc319f5bf4d77a46edf4680b40719fc4389b8292cb5fe31d7783e3e1f1ff","observation_id":"0a8592d8-34b1-4b60-b510-2b521753d5bd","resolution":{"observed_at":"2026-08-15T23:10:22.874512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.480828Z","title":null,"venue":null,"work_id":"10e7ba53-89c6-4118-9bc8-f15d9191cdf8","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.878688Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:59d8c897ce05f6df9fd9a8a112344ca7b55b18f278c0971790d9b0d2e2363298","observation_id":"08cfe4c7-f518-4228-92ba-2ceee993bb69","resolution":{"observed_at":"2026-08-15T23:10:24.486342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.465866Z","title":"Grunde-McLaughlin, R","venue":null,"work_id":"00cca5aa-2727-470e-8392-169f51a8a08d","year":2021},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.882729Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:c38f56d7ecf8419c8299ab964f27c7de65a976c61e2a194576032b076a770661","observation_id":"d92d037e-0ed4-4e14-90b6-16e742982226","resolution":{"observed_at":"2026-08-15T23:10:24.470764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.10301","last_updated":"2024-11-05T01:55:24Z","snapshot_observed_at":"2026-08-16T13:52:04.343245Z","submitted_at":"2024-05-16T17:55:24Z","title":"Conformal Alignment: Knowing When to Trust Foundation Models with Guarantees","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.10301","snapshot_observed_at":"2026-08-15T23:10:22.887104Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.887104Z"},"links":{"cited_paper":"/paper/2405.10301","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:c592f0890dfb265ebb4ec9862c02d16294525b08db1f9fb42286f49c467106dd","observation_id":"49173323-b1b1-4a9d-b17a-0d0cfcf4f52b","resolution":{"observed_at":"2026-08-15T23:10:22.887104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.451251Z","title":"Howard, A","venue":null,"work_id":"331bdc17-5f68-4c1b-9a3d-7419f51a909d","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.891943Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:569aa51709832e6c551af78830d3168a518b9960125c89da1e9078485293f34f","observation_id":"df3bd77f-4364-4da2-9e09-b9426e886ebc","resolution":{"observed_at":"2026-08-15T23:10:24.455741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.patrec.2024.01.009","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.251835Z","title":null,"venue":null,"work_id":"9cd11145-5aa2-4be8-b9d2-a6172d1beac0","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.895729Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:e6951092e2e52cb1a56eaa16f502c4003f986c7583484320c32a6a25f8eb3ce7","observation_id":"613dc825-1359-45bd-84cf-6a21529ec7a9","resolution":{"observed_at":"2026-08-15T23:10:23.257088Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.900035Z","title":"Huang, X","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.900035Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:baab9e268a191c0d27f51c9f0430be6c3fadac6f3d578b00701ca9c8b6d4b823","observation_id":"2ea4b43b-ca70-4623-9eca-c5625e27aa8e","resolution":{"observed_at":"2026-08-15T23:10:22.900035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.436730Z","title":"Huang, I","venue":null,"work_id":"a870068d-37fd-4a12-b38b-e4e00d353074","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.904323Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:9e7f9ff7be8225211df90f50d749b095c3f0f9e78ddc04e1f563c3bc287179c7","observation_id":"66fcfa15-5781-4dfc-80fb-18dce5965e93","resolution":{"observed_at":"2026-08-15T23:10:24.441291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05561","snapshot_observed_at":"2026-08-15T23:10:22.908814Z","title":"Huang, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.908814Z"},"links":{"cited_paper":"/paper/2401.05561","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:f35f90c451e6ae08e4c9995102342eac7b48616b9ab35f37054d43d32681da70","observation_id":"60c4c4d6-c4dd-478b-bcb7-70e70664182e","resolution":{"observed_at":"2026-08-15T23:10:22.908814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.421647Z","title":null,"venue":null,"work_id":"dea646e1-ff6d-429a-b81c-01e1f3960fb8","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.913284Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:6fc65a463a0b8d4580f9413298831056969ff592c8154aef0f447bf0de010827","observation_id":"8a42dcda-a790-46e2-914f-4796c1851d3b","resolution":{"observed_at":"2026-08-15T23:10:24.426213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.406480Z","title":null,"venue":null,"work_id":"91cc13a7-c709-4f4c-9416-757ac7d13400","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.917863Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:5ea03d0b4df440270e0108027d9018f704e82a403f0030304072680ebe209842","observation_id":"0790ebe0-54ad-49e2-bdb4-c3998dc049b0","resolution":{"observed_at":"2026-08-15T23:10:24.411440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.389631Z","title":"Kambhampati","venue":null,"work_id":"a8484f00-e8c0-4e25-a995-628d090084b7","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.922526Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:586678493407fb796641a513ab976d289052c4a68f89fd4863a8e42b1422c3b0","observation_id":"e882a46e-c9c9-4ab2-b736-bd31ffed2ef6","resolution":{"observed_at":"2026-08-15T23:10:24.395456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.375094Z","title":"Khan and Y","venue":null,"work_id":"633d620f-695b-4a76-8049-8577a890e2c1","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.926849Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:da53327b6861c862ee1d3f776d1bd4fbd2d57e0e33de3b7bf0c20faaf4616b41","observation_id":"5712db11-499a-4511-b06d-dc4f62e2eeb2","resolution":{"observed_at":"2026-08-15T23:10:24.379649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.359963Z","title":null,"venue":null,"work_id":"0c1d3f1a-7676-48d9-a286-029590e55553","year":2017},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.931060Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:89e7774f75b7e5d294af25717d737e24ce20f392d9e4876a88f99276f42c21c1","observation_id":"547ea547-0427-49c1-8ac1-d08529fba60a","resolution":{"observed_at":"2026-08-15T23:10:24.364846Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.343910Z","title":null,"venue":null,"work_id":"134c178b-f82d-4b29-bf3d-72cc87880695","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.935693Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:3b4e41a58dabd642d0cedba6c427aa027edab6303858a35c5fa600c9f88f8808","observation_id":"ea98fafa-9ca5-4385-b425-67ef9e8c9365","resolution":{"observed_at":"2026-08-15T23:10:24.349197Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.328410Z","title":null,"venue":null,"work_id":"a4ae3c12-6e4a-46e8-9c65-f24d939f0996","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.940836Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:26c7d9faf24d2d1b6cd7cffbd3abe16b6c5b07da5120724abf17c0032b41a8bc","observation_id":"790714ba-1eff-4bca-a4d1-4a568eac7700","resolution":{"observed_at":"2026-08-15T23:10:24.333788Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3645088","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.235840Z","title":"Li and G","venue":null,"work_id":"5922f687-93eb-405f-8905-262129005def","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.946012Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:36b5b499b6993d2c8e1f5d5091b33469ce7bf2d29aafd7c13c85e7e6a490c447","observation_id":"ef649b5e-91a1-40b1-b179-5ea95dc52cfe","resolution":{"observed_at":"2026-08-15T23:10:23.240835Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.311918Z","title":null,"venue":null,"work_id":"8e2e787f-b454-4cc3-a869-596499a3865a","year":2022},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.951164Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:443f47f161543bd4bd85e393a67b3e249facdcc769951f7c202a401a55f07706","observation_id":"4c9c6522-362a-4c19-911d-c4f016085d69","resolution":{"observed_at":"2026-08-15T23:10:24.316838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3694964","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.219388Z","title":null,"venue":null,"work_id":"1dfdcafc-f53e-494b-ad2c-09930f757848","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.955857Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:0821685e56f990483734649f684e228127d096e656cbba6eb186b9a7b6176826","observation_id":"ca7eb0d9-56e0-43ff-935a-67ee4881c41a","resolution":{"observed_at":"2026-08-15T23:10:23.224502Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.291148Z","title":null,"venue":null,"work_id":"635fe46b-5ea8-45c0-be4b-6fd43e0f5d88","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.960917Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:5d9a61f00ed9ca838855dea142b1bb6b1be96e638409bff784d29945d6c7fb3d","observation_id":"63d45299-ebad-420a-af11-c01e6d64ad5e","resolution":{"observed_at":"2026-08-15T23:10:24.298169Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:22.966893Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.966893Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:185362b227956c9fe11ce47ec065ba5c570f32e1cc5fde7547f5fe3f04809dbc","observation_id":"f44fd91d-9065-416a-abab-21a38180c78c","resolution":{"observed_at":"2026-08-15T23:10:22.966893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00357","last_updated":"2024-06-20T15:06:10Z","snapshot_observed_at":"2026-08-16T14:22:38.182009Z","submitted_at":"2024-02-01T05:57:10Z","title":"Safety of Multimodal Large Language Models on Images and Texts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00357","snapshot_observed_at":"2026-08-15T23:10:22.971662Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.971662Z"},"links":{"cited_paper":"/paper/2402.00357","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:2202f77809bd8496ddae37bf2341a1cbe98e4a1cafd8e3446e12085ab0e3e402","observation_id":"ba15c73c-8609-4fb2-a3be-41e2bb43b959","resolution":{"observed_at":"2026-08-15T23:10:22.971662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.269402Z","title":null,"venue":null,"work_id":"ffd2ff37-e557-4c04-b0f0-4c55a91059bc","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.976448Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:48df0310f541b0a3effcb4f7cd707ce3e2a5205daddf00c1b1a423ed3764f6ae","observation_id":"783276a1-6bd7-472f-9d19-2ad05d8dd09b","resolution":{"observed_at":"2026-08-15T23:10:24.276383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.248667Z","title":null,"venue":null,"work_id":"e5e4ccd4-1a71-41dd-81b6-c0da40726cb8","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.980875Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:4508e1ba31768cbf4e99f1f0683651d6608b01393fcd3f76d0337854a6bfe933","observation_id":"d4e8abb0-59de-42cc-a24c-854949681493","resolution":{"observed_at":"2026-08-15T23:10:24.254716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.231525Z","title":null,"venue":null,"work_id":"1a3fbdc5-7c62-473e-96f2-c443445486d4","year":1995},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.985919Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:b50982b6712c85191a55e09f359426349bc393c824f662105d69f9a58afd6944","observation_id":"60327eb8-b2d0-4835-af72-16b2fef3a292","resolution":{"observed_at":"2026-08-15T23:10:24.237018Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.214000Z","title":"Mehrotra, C","venue":null,"work_id":"33ccfaf3-c8c5-40ac-b193-da35140198cb","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.991617Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:1613539b613e9c8693d85a8579379647690b19532f05eee6d385665b02dcb9bc","observation_id":"19d4ed0e-de4b-4ecb-981a-68da7e581f80","resolution":{"observed_at":"2026-08-15T23:10:24.220017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3645090","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.190991Z","title":"Methnani, M","venue":null,"work_id":"804b7974-8479-47d9-acb9-a36aef9030e9","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.995609Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:c47dc0b01321b3c12deefa1fcc6c21619db2cb51889a717387fbc948833e7940","observation_id":"fe4313f7-0ae1-447e-9dca-7addbd0d3015","resolution":{"observed_at":"2026-08-15T23:10:23.197682Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07872","last_updated":"2024-02-12T18:33:47Z","snapshot_observed_at":"2026-08-16T14:19:14.631075Z","submitted_at":"2024-02-12T18:33:47Z","title":"PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07872","snapshot_observed_at":"2026-08-15T23:10:22.999721Z","title":"Nasiriany, F","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.999721Z"},"links":{"cited_paper":"/paper/2402.07872","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:9515e4b37c69bdbb876d13334e02770ffd251673a5ce77507448dd97ba737734","observation_id":"3560dda1-e017-497b-97c2-a83a1851eb77","resolution":{"observed_at":"2026-08-15T23:10:22.999721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.194803Z","title":"Novelli, M","venue":null,"work_id":"9b628c9d-015d-45e8-950c-df3210ba41e1","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.004373Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:a89163459e7477c59ae4fcac42712da11030e1f1bac67be30bca28c54b702fd7","observation_id":"048b685f-9f40-45ec-aa98-65a80d5e55ea","resolution":{"observed_at":"2026-08-15T23:10:24.201423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.176417Z","title":"Perez-Cerrolaza, J","venue":null,"work_id":"da1172e0-b23d-41ce-8a40-f8b3fdda4f37","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.008640Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:2cad75eeda9741efb2d14e234e9980cc3cafa57f2652ceb2722b316d800b67d8","observation_id":"239ae18d-72c4-4f60-a026-aabb663c4189","resolution":{"observed_at":"2026-08-15T23:10:24.182692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13121","last_updated":"2024-10-17T01:19:18Z","snapshot_observed_at":"2026-08-16T13:08:36.091265Z","submitted_at":"2024-10-17T01:19:18Z","title":"Trust but Verify: Programmatic VLM Evaluation in the Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13121","snapshot_observed_at":"2026-08-15T23:10:23.012626Z","title":"Prabhu, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.012626Z"},"links":{"cited_paper":"/paper/2410.13121","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:d2430fc3110196d49ff5e43a2c21b4903c50b153295feb996f5c3a58eb89d1f8","observation_id":"0f23f462-2c5c-437a-a6e6-9bfd91c5ba74","resolution":{"observed_at":"2026-08-15T23:10:23.012626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.156890Z","title":"Radford, J","venue":null,"work_id":"561d1871-3940-4da5-be7c-2a4a4dcf0211","year":2021},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.016928Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:f47503f7fdfe28c5c9c5d990f06f60d197d888b4d8effff662bf5c7fa60cccbc","observation_id":"73af4490-b55c-493b-9566-a084bef9f2a9","resolution":{"observed_at":"2026-08-15T23:10:24.164211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.138068Z","title":null,"venue":null,"work_id":"73957a71-50c5-4ae8-8a8d-bbaead62b998","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.021215Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:f3b1117ff3476ea95db97c9186676be1eb69cecbedc1842d48552b7a9ef2fe8c","observation_id":"a92c5fd4-ce3b-4564-b0cb-f8430b2902c7","resolution":{"observed_at":"2026-08-15T23:10:24.143792Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.119807Z","title":"Sermanet, T","venue":null,"work_id":"064f1938-a4d7-4a94-8784-f64e386de15b","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.025661Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:e2281e553e3cd9849bb0471e7dbf686f1be07ca1c32074677894dc9167ded012","observation_id":"22c0fb1b-534b-4152-8806-903ef321c7ee","resolution":{"observed_at":"2026-08-15T23:10:24.125913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16999","last_updated":"2024-11-04T05:50:56Z","snapshot_observed_at":"2026-08-16T14:06:34.438455Z","submitted_at":"2024-03-25T17:59:23Z","title":"Visual CoT: Advancing Multi-Modal Language Models with a Comprehensive Dataset and Benchmark for Chain-of-Thought Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16999","snapshot_observed_at":"2026-08-15T23:10:23.029848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.029848Z"},"links":{"cited_paper":"/paper/2403.16999","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:c9ffe94d8ac1d5fd1f69ea88be4829c947619054ae8242afba85b2114073088e","observation_id":"5a1e0eab-9437-4f46-b764-d21ba9db74be","resolution":{"observed_at":"2026-08-15T23:10:23.029848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.092310Z","title":"Shirai, C","venue":null,"work_id":"bfb0fec1-35e0-4ee6-8b9b-6ed1d5cf9900","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.034843Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:2a1f9a5f50515991300b9554eb78312e40369a3d08ea7124c34482672a058168","observation_id":"4a4cc70e-5aae-4e45-907d-3daa0ad1e20f","resolution":{"observed_at":"2026-08-15T23:10:24.097399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.076379Z","title":null,"venue":null,"work_id":"950b23c6-3b13-46c5-8a1f-2e25dd6e1f22","year":2017},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.039367Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:ce595b34c45a3e2e15f129a3a0361d2b96c1600c4f28a11ad228b3aea5e7e3c3","observation_id":"02d8b539-5d66-43bc-a326-9d5f5cdfadf5","resolution":{"observed_at":"2026-08-15T23:10:24.081570Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.060363Z","title":"Singh, R","venue":null,"work_id":"e0c9a902-fd2f-41c5-a649-b370d3405f19","year":2022},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.044327Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:b418fd6432d38c25a974f3eae7ef1e4108d2eb29d04cdb147807c7039eff027d","observation_id":"2024f9f1-d9db-43ee-8cf7-d5503d3246be","resolution":{"observed_at":"2026-08-15T23:10:24.066212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.048950Z","title":"Tocchetti, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.048950Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:becf82b443dd712ce27654d0d4c4d379bf137d5af1c0568e17db043acf321f78","observation_id":"7160d33e-fdb5-4140-99f9-0cc037b8ee9b","resolution":{"observed_at":"2026-08-15T23:10:23.048950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.045215Z","title":"Vatsa, A","venue":null,"work_id":"b55fc537-f5b2-40bb-b579-4a054c8c114d","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.053986Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:2ef6af7e7ee88a6475c07a640fbf1e71e3d41f4508c251372b0d99ea2d52b0a8","observation_id":"5209fb25-1ef3-485c-a448-06b5ac4e311e","resolution":{"observed_at":"2026-08-15T23:10:24.050054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.058477Z","title":"Verma, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.058477Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:60b26b7af06b92d56e3fd775b25ca1e42a09cc5445cbf88d62da860e9020db5e","observation_id":"8eb7be5b-2ed9-4497-9fe4-e264b4473880","resolution":{"observed_at":"2026-08-15T23:10:23.058477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02219","last_updated":"2025-05-30T11:40:41Z","snapshot_observed_at":"2026-08-19T07:03:01.292304Z","submitted_at":"2023-12-03T16:39:36Z","title":"Behind the Magic, MERLIM: Multi-modal Evaluation Benchmark for Large Image-Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02219","snapshot_observed_at":"2026-08-15T23:10:23.063436Z","title":"Villa, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.063436Z"},"links":{"cited_paper":"/paper/2312.02219","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:01aae81bc035184bb2c2ae18c4819b4a02dc48e1d62704d09789132d95a6beed","observation_id":"751b6ba8-c280-4357-b9ed-8cee9cb374ff","resolution":{"observed_at":"2026-08-15T23:10:23.063436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.029240Z","title":null,"venue":null,"work_id":"a6ce5ed2-0784-4db5-8060-3686b5dcabe1","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.068437Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:f9e3912b049b687c5a177f7eea09e84cb811b8030ad7817d3acaf81f91439d1b","observation_id":"4c891391-ac93-4faa-9b32-9409319e717a","resolution":{"observed_at":"2026-08-15T23:10:24.033781Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:24.014073Z","title":null,"venue":null,"work_id":"7722da35-c0fc-4f09-b988-1f873ac835c1","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.073890Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:cf979212f2a7cc3404286d94a5d353430e5a5720299e65a0fb474ddc64ca95bb","observation_id":"29626152-8eb8-4ecd-93d0-efe41d9aabdf","resolution":{"observed_at":"2026-08-15T23:10:24.018872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.996961Z","title":null,"venue":null,"work_id":"0b2f46c7-229a-4edb-adee-074f59aba8ec","year":2021},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.079329Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:e61f740f7571c900db6e1208f3b3d6af923982da9ce842956a2fd00af828480d","observation_id":"cf440171-9dde-40d4-9ae0-6aaf6506574e","resolution":{"observed_at":"2026-08-15T23:10:24.002004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.083716Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.083716Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:8cb0f6de11c2408ab0716b5846cf509573fa50c26e3b5f1aad9b097a3c5b32bd","observation_id":"07b94ccd-d99c-429c-94ff-906dd980a815","resolution":{"observed_at":"2026-08-15T23:10:23.083716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.981661Z","title":null,"venue":null,"work_id":"1683f0f8-956b-4f3e-ba83-2e0e0091eb3e","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.088046Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:cffc79e90b0eeefe6c0abca56ec261ecb1c8d18af39adac697b1bbb9d58728f3","observation_id":"1714a063-8582-4c20-b3e4-30b08502e04d","resolution":{"observed_at":"2026-08-15T23:10:23.986517Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.963883Z","title":null,"venue":null,"work_id":"376e9635-acb0-440d-af05-6e127b79ebbe","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.092954Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:6aa61d9e76b0b77c6f0631eef728b10bb1928866ae9512c6929e61ecf9224763","observation_id":"6c7a7666-df58-4be5-aeb3-c533fd71c85b","resolution":{"observed_at":"2026-08-15T23:10:23.970640Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.946648Z","title":"Ye-Bin, N","venue":null,"work_id":"878f3c1b-7437-43a6-9bd2-31a4be7afe62","year":2025},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.097448Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:466fd1d23caca329c53c5b61ebdf3997490e78c20a8515527beb01b6d54e9622","observation_id":"21cf72ac-38e8-4bf2-bbf1-1f90df9d5ef6","resolution":{"observed_at":"2026-08-15T23:10:23.952044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.101674Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.101674Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:a9f099a5166dd921597704cb7b6d85e127b0f7aa9866de89130507bd88007d97","observation_id":"d748ac3d-166d-4030-817f-acd82c337ca9","resolution":{"observed_at":"2026-08-15T23:10:23.101674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.930104Z","title":null,"venue":null,"work_id":"a515d6c6-8555-4c9e-8826-13061f2a1374","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.105810Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:2bb5898c68153a0659f23a6aa0a053c310994e307d72dc2d7314d47c7392fb78","observation_id":"893610f8-7bcf-4a1c-b228-12434c1e7298","resolution":{"observed_at":"2026-08-15T23:10:23.934982Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.913103Z","title":"Zanotti, M","venue":null,"work_id":"f8f74d20-9dc9-449b-8d62-efdfc55743fb","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.110950Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:6cc996c1bdafc8e97f1f86b9b5ad7ddf46ff813782e20a602247aa10229f6b15","observation_id":"23c6192f-7503-4da3-b5c7-ddc9a5d48473","resolution":{"observed_at":"2026-08-15T23:10:23.918048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.897039Z","title":"Zhang, J","venue":null,"work_id":"984335fe-c58f-434c-9148-9336942cfed3","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.115302Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:d685d47116386fe9802fef9b40643660f33e5ddfd918a72473024c2b158bb27d","observation_id":"beb986d0-2bf1-4cbd-9a42-599396eba5e0","resolution":{"observed_at":"2026-08-15T23:10:23.901979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12030","last_updated":"2025-05-21T04:55:10Z","snapshot_observed_at":"2026-08-17T05:28:50.285614Z","submitted_at":"2024-06-17T18:57:37Z","title":"SPA-VL: A Comprehensive Safety Preference Alignment Dataset for Vision Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12030","snapshot_observed_at":"2026-08-15T23:10:23.119989Z","title":"Zhang, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.119989Z"},"links":{"cited_paper":"/paper/2406.12030","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:fa11052654e8f19cfe8c32c70fcc76f934826330bdae43d53857a1cee21911ea","observation_id":"3669a81a-8a91-40b0-b549-01d3a23fde78","resolution":{"observed_at":"2026-08-15T23:10:23.119989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.880868Z","title":null,"venue":null,"work_id":"10343db6-f761-4345-8b56-c84e7d285510","year":2023},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.125191Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:da7dee6c073e13a0f146525c533740f3747add23c73eee1fd93b85f704825634","observation_id":"1fd70dd8-3cce-4f02-aaed-bdc85d297656","resolution":{"observed_at":"2026-08-15T23:10:23.885757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:10:23.865606Z","title":"Zheng, J","venue":null,"work_id":"96a7129f-ce4e-43c5-a81c-e7f91cc1ca54","year":2024},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:23.129223Z"},"links":{"citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:b8dd6f29e50726f267821326d1f2217c130c9169c7defdce0126ab387fd9a32d","observation_id":"2759ae62-e138-4f04-8123-c919a57450e0","resolution":{"observed_at":"2026-08-15T23:10:23.869919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15300","last_updated":"2024-04-23T09:32:25Z","snapshot_observed_at":"2026-08-18T09:54:15.367447Z","submitted_at":"2024-02-23T12:57:16Z","title":"Seeing is Believing: Mitigating Hallucination in Large Vision-Language Models via CLIP-Guided Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15300","snapshot_observed_at":"2026-08-15T23:10:22.859962Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T23:10:22.859962Z"},"links":{"cited_paper":"/paper/2402.15300","citing_paper":"/paper/2505.05318"},"observation_digest":"sha256:bebb84070c5f363f5984b193d804c35d5580d2dd76af1dd094753ecae31e79b5","observation_id":"b28f7083-3a13-4f48-b924-8c040fd8567f","resolution":{"observed_at":"2026-08-15T23:10:22.859962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.05318","last_updated":"2025-05-08T15:02:49Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T23:04:42.090312Z","submitted_at":"2025-05-08T15:02:49Z","title":"Mapping User Trust in Vision Language Models: Research Landscape, Challenges, and Prospects"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":4,"verified_fuzzy":21},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 1 inbound Pith citation observation for arXiv:2505.05318."}