{"as_of":"2026-08-09T20:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:89fb91ec251ba6bbaec9d973b85fed80115010afd792a6a623dad368beab743f","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:58:01.385743Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.21335/citation-record","integrity":"/paper/2507.21335/integrity","json":"/paper/2507.21335/citation-record.json","paper":"/paper/2507.21335"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.302775Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.302775Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:f8da854d00921425c17070d96a12cf3a104c33b14749f47aa5b27c3a59696aca","observation_id":"ac221131-ecee-4acd-abb9-c6c86238947d","resolution":{"observed_at":"2026-08-06T12:58:01.302775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.308197Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.308197Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:94641a7a7b42bbe0f2e82f11cea4297ce18960e10a0be20f7a06ea814e60448c","observation_id":"7b2211c4-390d-4cbe-ab4b-633b2ec7f258","resolution":{"observed_at":"2026-08-06T12:58:01.308197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.640486Z","title":null,"venue":null,"work_id":"de493874-41a6-4776-8795-be5ef4468805","year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.312144Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:1154b6819b3b5f9a177dcb75459f58db0440f3e751a4400ca552ff0fc7da404b","observation_id":"c5b4d3c0-1a2c-419d-9779-3934d2920ca3","resolution":{"observed_at":"2026-08-06T12:58:01.644291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.315514Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.315514Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:5a067475d438bbcf8c38f40233734568c664302eb25c0286641b226c17f0522c","observation_id":"3c9df4a3-3254-4c11-981a-b60aa734bb20","resolution":{"observed_at":"2026-08-06T12:58:01.315514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.619799Z","title":null,"venue":null,"work_id":"520f9932-b2bf-4270-9b5e-64cfbb3363f1","year":2022},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.318678Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:bfb1a916a66a04920379cac790afbd824d14a467c0cccd9422ab7f86e013aee1","observation_id":"1aa4f239-c6eb-4355-ac41-6ca8b2f175a7","resolution":{"observed_at":"2026-08-06T12:58:01.623753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.607813Z","title":null,"venue":null,"work_id":"58452693-3603-4734-b35d-b9c04da920ba","year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.321753Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:cdd52d8d7f41badb622c6df73495ceb7e42f4ca6f4d9026be0625935f28a6b1c","observation_id":"5199c0c7-3b31-4143-83d5-265b25749c74","resolution":{"observed_at":"2026-08-06T12:58:01.611618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.325361Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.325361Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:0cad67982f9b9f4b1d9c1ca1bdd22b4ee7ecac129fbe06fa5eb8140ea4a81b5d","observation_id":"d36ac070-4fe3-4450-89a3-a821fb33626f","resolution":{"observed_at":"2026-08-06T12:58:01.325361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.328290Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.328290Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:78c4d021fbf7fd0d3df24edd74423394ae1a178e4a39155c3d8b76e1df2898bc","observation_id":"59166c72-65e1-463d-8dd8-a3576ed1365e","resolution":{"observed_at":"2026-08-06T12:58:01.328290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.584753Z","title":null,"venue":null,"work_id":"0480b878-119e-4bfb-835b-8c04094393b2","year":2020},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.331903Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:9d227cbed826fbb1811bf58288ad60ecca7e402153c7b05db9d3d2dae62f35bf","observation_id":"65ed488e-0ecb-4c9e-bdf8-521923c9701b","resolution":{"observed_at":"2026-08-06T12:58:01.588246Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.573368Z","title":null,"venue":null,"work_id":"1b549cc9-fdff-4015-b7be-6ad6a3a4f7a3","year":2000},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.336014Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:0d6784eaf6123b36a12666236c0a645f2a56ecd61b4931c595e7687d54eb40e6","observation_id":"fb94189d-49ff-47d9-9a4a-c8a1f4284759","resolution":{"observed_at":"2026-08-06T12:58:01.576461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.563339Z","title":null,"venue":null,"work_id":"d607e636-4da8-4706-af7a-11c54efc9278","year":1998},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.339423Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:d7547763b0aec9f7050e5abfa96f288306dca1d38a783387043dc151090bd439","observation_id":"f248bbce-b326-4b73-bf50-53d02b89b04a","resolution":{"observed_at":"2026-08-06T12:58:01.566583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.342128Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.342128Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:21ccc7b265a1524a45eb0c88603a4d87738fa34201ef480f1dd7f044299e6ab1","observation_id":"4a014d6d-249b-42d1-809f-50a756d54f61","resolution":{"observed_at":"2026-08-06T12:58:01.342128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.345600Z","title":null,"venue":null,"work_id":null,"year":1975},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.345600Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:227e5a069b361adef80d55eebf777a74f9e4eed47c741a18bf1c225039bce13e","observation_id":"bb6cf1e3-54a8-4f17-9fd0-22aa9bb54271","resolution":{"observed_at":"2026-08-06T12:58:01.345600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T12:58:01.348309Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.348309Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:514035f7461984bea87f222752142ee8bd5427d831ceb2d3e0ebdbbb7b398141","observation_id":"ba70bf8f-c936-463e-ac3e-6320ef72f1d7","resolution":{"observed_at":"2026-08-06T12:58:01.348309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.535448Z","title":null,"venue":null,"work_id":"3d1c6432-2148-4e23-a37c-c97a7286ff56","year":2018},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.351351Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:2e7833a2696ca468928cd6356b1d4170fed50c8c50b199a94f24eae723d38f53","observation_id":"eb506337-5b20-4aba-8996-9426aa66869e","resolution":{"observed_at":"2026-08-06T12:58:01.538651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.523928Z","title":null,"venue":null,"work_id":"82e93204-183a-4314-8702-0a22942eadbb","year":1996},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.355186Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:cc3d8c9e5ac26a977b01f5c24814798c35bceb4252f5ed75ad6c0f9b75c3c622","observation_id":"62763ddb-5de0-4798-877e-a8973016e09a","resolution":{"observed_at":"2026-08-06T12:58:01.527054Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.358224Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.358224Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:853b4db7c4fb19d6dd6d76012603c9ff7e77ccceabb32ec4e69b3ba32dcd73fb","observation_id":"87b83ab0-41ce-4e1f-bc9f-6cdf1806f9be","resolution":{"observed_at":"2026-08-06T12:58:01.358224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.505434Z","title":null,"venue":null,"work_id":"e6587db0-50ac-431e-8637-6f6a2fb77b2f","year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.361372Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:727769e7457cf972fded3491108f9ad733a7f50e677b4ab33c44dd0b9b05a8a3","observation_id":"38ceacf5-03cf-4ce2-8712-f53b785b74fd","resolution":{"observed_at":"2026-08-06T12:58:01.508515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.494526Z","title":null,"venue":null,"work_id":"0bcabf64-60f2-4550-8d58-ef98aeb89e6b","year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.364808Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:098cc069571d8bdb8b36e2394e86c3608557fd6c6a327db5a6c57442c7b01ee4","observation_id":"0707af02-b80a-44d0-b2ac-46492a695fe9","resolution":{"observed_at":"2026-08-06T12:58:01.497499Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.481986Z","title":null,"venue":null,"work_id":"2be38aa9-1e80-453a-b127-3ee902c3c781","year":2020},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.367374Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:1724619c5b913940d6515c16fbac9153fbfc7bd7ecb4e25cca2b32c2cbe44ac0","observation_id":"706d9c05-8131-4f5d-8f69-22fa2424b87b","resolution":{"observed_at":"2026-08-06T12:58:01.485368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07490","last_updated":"2019-12-03T19:30:19Z","snapshot_observed_at":"2026-08-09T06:33:58.539983Z","submitted_at":"2019-08-20T17:05:18Z","title":"LXMERT: Learning Cross-Modality Encoder Representations from Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07490","snapshot_observed_at":"2026-08-06T12:58:01.370083Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.370083Z"},"links":{"cited_paper":"/paper/1908.07490","citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:c30c9d18289a18c21c3cff46ac3025049b1ea965e61361e96cd49ecda82e7388","observation_id":"91065e8e-bc80-41f5-afc7-13d83357015c","resolution":{"observed_at":"2026-08-06T12:58:01.370083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T12:58:01.372850Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.372850Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:439776676d60fd8aaf55b6b22e0d39ac7d77fcc2b95f2b53859becce6293a72e","observation_id":"7d6d7e5d-b647-4e1e-a79f-434632a8a03c","resolution":{"observed_at":"2026-08-06T12:58:01.372850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.470433Z","title":null,"venue":null,"work_id":"121230da-f8f4-4284-96ac-7e2a461c54e6","year":2008},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.376225Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:55b03c12e168ca59a8f31762fd775fc8432db6c1ffd45de2888711b199dc6788","observation_id":"50b925df-0b02-4a8b-a625-8c0a8355c21b","resolution":{"observed_at":"2026-08-06T12:58:01.473907Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.459386Z","title":null,"venue":null,"work_id":"b346e9ff-c911-4a68-ab1c-eb18d69d900f","year":2022},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.379266Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:57d6e925708d8c3e0bffa7ecba42e9dc95956b6e7daa0a385a006f4174a44259","observation_id":"b985f387-fc3d-4c59-aa04-4a9677e8d458","resolution":{"observed_at":"2026-08-06T12:58:01.463085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.446722Z","title":null,"venue":null,"work_id":"181ad80b-e975-43ab-9d46-086c96d92a06","year":2019},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.382308Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:8dd8f5cda4c6bbfc8486d5daa16f14f062e1a05e38533ddee35d4b69d98e4d14","observation_id":"5668cf93-4b5c-459e-ad80-fedab7362c86","resolution":{"observed_at":"2026-08-06T12:58:01.450808Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:58:01.385743Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T12:58:01.385743Z"},"links":{"citing_paper":"/paper/2507.21335"},"observation_digest":"sha256:ccbf25752c7bc65cf8828b9eb672f0ef3225be8846dbfa82b4d9bfabedcd88ae","observation_id":"cb497a8c-0093-4d53-8c1a-60f62f672650","resolution":{"observed_at":"2026-08-06T12:58:01.385743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.21335","last_updated":"2025-07-28T21:01:28Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T06:34:45.762903Z","submitted_at":"2025-07-28T21:01:28Z","title":"Analyzing the Sensitivity of Vision Language Models in Visual Question Answering"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2507.21335."}