{"as_of":"2026-08-21T15:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e9d022c310bdfaead31468273415f4a3e84c7d11127e15b5d65afc2b818f4146","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:04:22.020535Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:22:04.563578Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T21:00:09.515721Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13690","snapshot_observed_at":"2026-08-03T20:41:51.663409Z","title":"Analysing the robustness of vision-language-models to common corruptions.CoRR, abs/2504.13690, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.19032","last_updated":"2026-07-09T04:07:40Z","snapshot_observed_at":"2026-08-16T06:03:41.986353Z","submitted_at":"2025-11-24T12:07:56Z","title":"Diagnosing Corruption-Induced Reliability Failures in Vision-Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T20:41:51.663409Z"},"links":{"cited_paper":"/paper/2504.13690","citing_paper":"/paper/2511.19032"},"observation_digest":"sha256:d0800982d608573d3b57137179030f9304d102fa2cdd7ba9bece59cb3b866451","observation_id":"6347e853-a133-481b-b9c4-788953edc8de","resolution":{"observed_at":"2026-08-03T20:41:51.663409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"cited_work":{"arxiv_id":"2504.13690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.13690","snapshot_observed_at":"2026-07-04T21:00:09.515721Z","title":"Analysing the Robustness of Vision-Language-Models to Common Cor- ruptions","venue":null,"work_id":"6b65e8fc-fb53-4a45-8115-ade8075eabf8","year":2025},"citing_paper":{"arxiv_id":"2604.17243","last_updated":"2026-04-19T04:04:44Z","snapshot_observed_at":"2026-07-06T23:04:23.730478Z","submitted_at":"2026-04-19T04:04:44Z","title":"RemoteShield: Enable Robust Multimodal Large Language Models for Earth Observation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T06:48:11.250689Z"},"links":{"cited_paper":"/paper/2504.13690","citing_paper":"/paper/2604.17243"},"observation_digest":"sha256:2a2ca4b1c38b7a18407b4284011d6d8e37506efe9658fc72c9db94e4c5126587","observation_id":"e1071650-d258-4884-8db0-38d8086cdca8","resolution":{"observed_at":"2026-05-10T06:51:46.271817Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"cited_work":{"arxiv_id":"2504.13690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.13690","snapshot_observed_at":"2026-07-04T21:00:09.515721Z","title":"Analysing the Robustness of Vision-Language-Models to Common Cor- ruptions","venue":null,"work_id":"6b65e8fc-fb53-4a45-8115-ade8075eabf8","year":2025},"citing_paper":{"arxiv_id":"2604.18829","last_updated":"2026-04-20T20:51:39Z","snapshot_observed_at":"2026-08-21T01:14:02.188183Z","submitted_at":"2026-04-20T20:51:39Z","title":"DUALVISION: RGB-Infrared Multimodal Large Language Models for Robust Visual Reasoning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-10T04:53:49.843455Z"},"links":{"cited_paper":"/paper/2504.13690","citing_paper":"/paper/2604.18829"},"observation_digest":"sha256:2cadeee3943f5e2eb03d3c2aae25bc2f8ca31eb0b719ae64dfdf4102316534d3","observation_id":"3ba9a9cf-42bc-4929-a585-7291c0d87be9","resolution":{"observed_at":"2026-05-10T11:10:09.800498Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"cited_work":{"arxiv_id":"2504.13690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.13690","snapshot_observed_at":"2026-07-04T21:00:09.515721Z","title":"Analysing the Robustness of Vision-Language-Models to Common Cor- ruptions","venue":null,"work_id":"6b65e8fc-fb53-4a45-8115-ade8075eabf8","year":2025},"citing_paper":{"arxiv_id":"2606.08894","last_updated":"2026-06-08T00:40:32Z","snapshot_observed_at":"2026-08-14T20:30:05.906907Z","submitted_at":"2026-06-08T00:40:32Z","title":"Are Reasoning Vision-Language Models Robust to Semantic Visual Distractions?","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T17:36:42.185657Z"},"links":{"cited_paper":"/paper/2504.13690","citing_paper":"/paper/2606.08894"},"observation_digest":"sha256:ec3db103929775472b04685aaa399fb4b05e729fe26759a25d41f5fefac4eac0","observation_id":"3b84f120-34da-4392-9819-25a891a79204","resolution":{"observed_at":"2026-07-02T23:57:28.942680Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"cited_work":{"arxiv_id":"2504.13690","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.13690","snapshot_observed_at":"2026-07-04T21:00:09.515721Z","title":"Analysing the Robustness of Vision-Language-Models to Common Cor- ruptions","venue":null,"work_id":"6b65e8fc-fb53-4a45-8115-ade8075eabf8","year":2025},"citing_paper":{"arxiv_id":"2606.26041","last_updated":"2026-06-24T17:15:42Z","snapshot_observed_at":"2026-08-02T15:35:24.404490Z","submitted_at":"2026-06-24T17:15:42Z","title":"How Robust is OCR-Reasoning? Evaluating OCR-Reasoning Robustness of Vision-Language Models under Visual Perturbations","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-25T19:13:27.527971Z"},"links":{"cited_paper":"/paper/2504.13690","citing_paper":"/paper/2606.26041"},"observation_digest":"sha256:875a8537aaded26ee2d03ea14f9dcece89a65ba5a3691ead32ecdfda12f4355d","observation_id":"dd6525cc-7749-400e-82ec-f32ee749cc0e","resolution":{"observed_at":"2026-07-04T21:00:09.517382Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13690","snapshot_observed_at":"2026-08-11T00:22:04.563578Z","title":"Analysing the robustness of vision-language-models to common corruptions.CoRR, abs/2504.13690, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07742","last_updated":"2026-08-07T20:19:11Z","snapshot_observed_at":"2026-08-16T02:07:37.994780Z","submitted_at":"2026-08-07T20:19:11Z","title":"BRUCE: Benchmarking Robustness Under Corruption Escalation for Scientific Vision-Language Reasoning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T00:22:04.563578Z"},"links":{"cited_paper":"/paper/2504.13690","citing_paper":"/paper/2608.07742"},"observation_digest":"sha256:4c8d413e7671fc41cb97bf55d712e561d8bad88139c064faae634a569938d6c5","observation_id":"0a276d57-6442-4410-84f5-be29e78194bc","resolution":{"observed_at":"2026-08-11T00:22:04.563578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.13690/citation-record","integrity":"/paper/2504.13690/integrity","json":"/paper/2504.13690/citation-record.json","paper":"/paper/2504.13690"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.332055Z","title":"Benchmarking neural network robustness to common corruptions and perturbations,","venue":null,"work_id":"6198a6c8-16f6-44a8-bcad-7af575032111","year":2019},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.911342Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:ade8dd6566d40ea388f7d68ebaa4e9dce24df8b55563a6694573c969fea249e4","observation_id":"53884e7d-663e-4487-a5fd-816e3a257597","resolution":{"observed_at":"2026-08-16T12:04:22.334993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.323401Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":"e585811d-b85f-4eba-a417-4246f91d94d0","year":2021},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.915328Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:fa3e542eede790063c61a8f8f4b24c1b7426b9ae7e8d6177f4064a194b952d9c","observation_id":"399d1dee-1320-4e63-86e3-39dddaea976e","resolution":{"observed_at":"2026-08-16T12:04:22.326320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07490","last_updated":"2019-12-03T19:30:19Z","snapshot_observed_at":"2026-08-17T10:15:40.814612Z","submitted_at":"2019-08-20T17:05:18Z","title":"LXMERT: Learning Cross-Modality Encoder Representations from Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07490","snapshot_observed_at":"2026-08-16T12:04:21.918408Z","title":"Lxmert: Learning cross-modality encoder representations from transformers,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.918408Z"},"links":{"cited_paper":"/paper/1908.07490","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:ed6574a900db0be6e9932860d65111df47ca2ef179e2608fbe052d3a8a856d4a","observation_id":"32a891c9-1b94-40c6-884c-c061bb702925","resolution":{"observed_at":"2026-08-16T12:04:21.918408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.10480","last_updated":"2022-03-27T19:09:39Z","snapshot_observed_at":"2026-08-21T14:42:34.107811Z","submitted_at":"2022-03-20T07:51:46Z","title":"Encoder-Decoder Architecture for Supervised Dynamic Graph Learning: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.10480","snapshot_observed_at":"2026-08-16T12:04:21.921803Z","title":"Encoder-decoder architecture for supervised dynamic graph learning: A survey,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.921803Z"},"links":{"cited_paper":"/paper/2203.10480","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:9a231183377d26a2eb89b7148214e4112edc9e8b0be932c6fb450aa12d31370c","observation_id":"45cc0189-7c75-41d6-bbd0-1e5fa7e5c829","resolution":{"observed_at":"2026-08-16T12:04:21.921803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.315338Z","title":"Uninet: Unified architecture search with convolution, transformer, and mlp,","venue":null,"work_id":"7658f4ef-831d-4cfa-9f41-256ad5cd6548","year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.925188Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:8f27194a8e9dafb57757a764c9858c829d9d57ceeec01234c63834f02e26e73a","observation_id":"ee3353c6-803c-414a-86a5-d9e3416dfbd5","resolution":{"observed_at":"2026-08-16T12:04:22.318096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.307022Z","title":"Image difference captioning with pre-training and contrastive learning,","venue":null,"work_id":"5da382cd-4d24-42fb-84ae-48318252d83c","year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.928043Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:023b01da7789620af9ab1838fdac69d096f3cca988751a4de91d9954723b7ffc","observation_id":"18a1b0be-1307-48c2-bd66-66ba9d872568","resolution":{"observed_at":"2026-08-16T12:04:22.310092Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.13655","last_updated":"2022-03-18T05:04:22Z","snapshot_observed_at":"2026-08-21T07:09:08.177281Z","submitted_at":"2021-08-31T07:37:43Z","title":"MELM: Data Augmentation with Masked Entity Language Modeling for Low-Resource NER","version":2},"cited_work":{"arxiv_id":"2108.13655","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.13655","snapshot_observed_at":"2026-08-16T12:04:22.109796Z","title":"MELM: Data Augmentation with Masked Entity Language Modeling for Low-Resource NER","venue":"cs.CL","work_id":"42b515a6-c346-416c-9574-d6c9f1ff6eb2","year":2021},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.931054Z"},"links":{"cited_paper":"/paper/2108.13655","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:92b2cb94cc39d4a3e489a02d7493e46f5ac285a2cefdb7842394fb5a56952d4f","observation_id":"f6bae221-e36b-4347-8fd8-0e428cfa997d","resolution":{"observed_at":"2026-08-16T12:04:22.114352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.298983Z","title":"Point-bert: Pre-training 3d point cloud transformers with masked point modeling,","venue":null,"work_id":"7bae109a-c3ff-4478-af4c-04171e110e29","year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.933943Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:cc2c7861ed0ae40a54694e31a77ad71b5c6e6f6ed2f96442f327f3c084c68035","observation_id":"2a6e0582-47b5-401e-bf6d-ed99641cd119","resolution":{"observed_at":"2026-08-16T12:04:22.301831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.290022Z","title":"Ensemble deep learning for automated visual classification using eeg signals,","venue":null,"work_id":"53b15719-9b54-4e5c-8d1d-a10653722f46","year":2020},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.936528Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:691291ccee6b669c3e8ea841af10a5873b5bbaad56455f30e33300b5056ff700","observation_id":"8f64a85f-ce5a-4de0-acd1-d4b4aaf8d553","resolution":{"observed_at":"2026-08-16T12:04:22.293121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.281546Z","title":"Lit: Zero-shot transfer with locked-image text tuning,","venue":null,"work_id":"fc383b11-e438-4f52-b950-78413b1c16f8","year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.939247Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:66d121b99c7591bce36312ca48bd2330553a27cd50ee51700b7426612e12b112","observation_id":"0076507b-c38e-4b3c-aa84-db30bbd2ae78","resolution":{"observed_at":"2026-08-16T12:04:22.284442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.273481Z","title":"Multimodal few-shot learning with frozen language models,","venue":null,"work_id":"3d933979-89b1-4014-b538-eccc53ada644","year":2021},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.941839Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:03859dbe93ad991daa3b3c226088f6147be7aef9f3f682f0d7b71f452abbc4af","observation_id":"ab689c34-d652-48d4-9715-886058522ab3","resolution":{"observed_at":"2026-08-16T12:04:22.276437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.265328Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen im- age encoders and large language models,","venue":null,"work_id":"8acb3299-4744-4c0f-ada5-fac0e04e1381","year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.944329Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:cf877c8ef58177e7bea1a632b93d47ef5ab7ed618fdd53f7d280fe3318e48b2f","observation_id":"eb69c2e4-bcb1-4ed2-976a-f12524b3f9cd","resolution":{"observed_at":"2026-08-16T12:04:22.268406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.257250Z","title":"Bert: Pre-training of deep bidirectional trans- formers for language understanding,","venue":null,"work_id":"c5868a0e-b1e5-42e5-b844-3cf698d6168d","year":2019},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.947076Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:4cfbc401ae3056a10feed9eacda81e4bb6cad3ee65d4cba011639705113efc7e","observation_id":"a1a7ba43-3ad2-4508-ab76-8847896dcf46","resolution":{"observed_at":"2026-08-16T12:04:22.260232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.249087Z","title":"Language models are unsu- pervised multitask learners,","venue":null,"work_id":"4ba155a9-7406-4209-9a9d-a0281a9fe6c9","year":2019},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.949507Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:398ec8950e30d1ce64880892d0a40222eee5fb4b9128910c546a5e93755e487e","observation_id":"4079734a-cbdd-45b4-b4bd-fa8edfda220d","resolution":{"observed_at":"2026-08-16T12:04:22.251988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:21.952092Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.952092Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:598092348a623bea24c9d5bd1b874076fa2214168f8a53e614072c8fe94b3fdb","observation_id":"f2b6acca-92b0-4111-84d4-61c0af404d2a","resolution":{"observed_at":"2026-08-16T12:04:21.952092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.236579Z","title":"Language models are few- shot learners,","venue":null,"work_id":"3c1bf1ef-7ad8-4b67-8d4a-6bc9e28e7bd0","year":1901},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.954684Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:b1fedf4650352aad21f37e1687114cd8501c713e867ad09fb553762f1274bc0f","observation_id":"b2e42023-4e5e-4cf8-8d5d-15d74de31d44","resolution":{"observed_at":"2026-08-16T12:04:22.239455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11990","last_updated":"2022-02-04T18:02:23Z","snapshot_observed_at":"2026-08-20T20:09:31.615952Z","submitted_at":"2022-01-28T08:59:57Z","title":"Using DeepSpeed and Megatron to Train Megatron-Turing NLG 530B, A Large-Scale Generative Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11990","snapshot_observed_at":"2026-08-16T12:04:21.957319Z","title":"Using deepspeed and megatron to train megatron-turing nlg 530b, a large-scale generative language model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.957319Z"},"links":{"cited_paper":"/paper/2201.11990","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:9ef01315e41e5c9476c587b32c47ac9a6a3cf91bf7c89574b2d4f156ba0348c3","observation_id":"51881d07-de52-433b-a8ff-ef828f30af07","resolution":{"observed_at":"2026-08-16T12:04:21.957319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-21T02:12:10.329412Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-16T12:04:21.960158Z","title":"Training compute-optimal large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.960158Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:96c36ac1aab1ee874c125d70064cc0dcb17ba731e070cabdd0ff787add084fb7","observation_id":"4f9f011b-090f-4e85-b5e0-3c786ed8ccaa","resolution":{"observed_at":"2026-08-16T12:04:21.960158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.228576Z","title":"Palm: Scaling language modeling with pathways,","venue":null,"work_id":"f7792746-8c03-4bb7-a7b2-25614d874abb","year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.963311Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:bd2c2ab19ea29f567ad6586a008a459b01171dd76dda3f6324c4783232ddaba8","observation_id":"ca9be42c-4823-4028-ae66-ed2a660e3495","resolution":{"observed_at":"2026-08-16T12:04:22.231453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-16T12:04:21.965842Z","title":"Opt: Open pre-trained transformer language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.965842Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:d51114353d3d42205546099ab22c8f0210aed1ce2062cd0f268928163a4da90e","observation_id":"776989c8-a9f6-495a-9768-627b35e3b5b8","resolution":{"observed_at":"2026-08-16T12:04:21.965842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-16T12:04:21.968804Z","title":"Bloom: A 176b-parameter open-access multilingual language model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.968804Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:7485e4a5d5d8d4cfe0de7cf4c5bda44d46199d6f9cee1234e4d4c9264d6e9b64","observation_id":"0ffee348-12cd-4681-9bec-c6d5de938996","resolution":{"observed_at":"2026-08-16T12:04:21.968804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-17T00:14:01.413100Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-16T12:04:21.971715Z","title":"Emergent abilities of large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.971715Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:31445f486195711225f500d98f5d2c6f0faca936bce228eeea0d2baa814d3a6a","observation_id":"bbcbfd4b-f48c-4b70-b85e-5a1e7c990ae3","resolution":{"observed_at":"2026-08-16T12:04:21.971715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:21.974662Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.974662Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:ae5b4e9d2edbe32b70beb96b5e9b5395a46627519c8746b0d78d368565ef62a5","observation_id":"537a4ab1-48df-4047-9519-cbb2d8a8898f","resolution":{"observed_at":"2026-08-16T12:04:21.974662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.216024Z","title":"Openai: Introducing chatgpt","venue":null,"work_id":"55aa7fe3-d018-458c-9646-c0f5a6c41456","year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.977233Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:9dd61b078558560d28ec54cd8d92e2528a9779d2112c5ec0b161aeb1bd5bb468","observation_id":"a568efa8-c177-499a-b7f9-4468ad956572","resolution":{"observed_at":"2026-08-16T12:04:22.218954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-16T12:04:21.980142Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.980142Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:41634b3c278908c5c3ba1c1034997e4e6f03367bef3e9d5638982e0bb6be2530","observation_id":"5f4c8e32-4805-41b4-bd50-c840b803d9a8","resolution":{"observed_at":"2026-08-16T12:04:21.980142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.207799Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality,","venue":null,"work_id":"7bacf9c2-73a6-47ef-9ed6-839510bb79e5","year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.982874Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:9129ec36faabbb378bbd86b29d49ce3c6570819142e1b982a83d057422c8525b","observation_id":"bd0cbe93-fbd7-45b1-bb7e-b830e121f4f1","resolution":{"observed_at":"2026-08-16T12:04:22.210674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:21.985674Z","title":"Visual instruction tuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.985674Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:400a235d4efbe9c6347cf6e832392e8a92f4d5185f9d2c95e6b9cd72322aeb0f","observation_id":"b368c416-0f33-4116-9304-d6fe109ed538","resolution":{"observed_at":"2026-08-16T12:04:21.985674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-16T12:04:21.988312Z","title":"Minigpt-4: Enhancing vision-language under- standing with advanced large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.988312Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:cbcae46215eb40a2a639d9fffe148c6960e249e1be455fed74c91c6a81441253","observation_id":"c467ae4d-f04c-4027-95c6-e6f94bbb06d1","resolution":{"observed_at":"2026-08-16T12:04:21.988312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.194782Z","title":"Visualgpt: Data-efficient adaptation of pretrained language models for image captioning,","venue":null,"work_id":"cb8aa9af-f416-4616-b7f1-e7a913da889c","year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.991201Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:ef1cb9ee9a3e7cac0c17335c6d24b53a31ff9a7eaef0bd81c9b5d251374bea2a","observation_id":"673a64dc-4b4f-4b92-8f62-5464b8fd7d89","resolution":{"observed_at":"2026-08-16T12:04:22.197834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.185935Z","title":"Flamingo: a visual language model for few-shot learning,","venue":null,"work_id":"d8db6136-2312-48d1-af4b-70033818eb2d","year":2022},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.993752Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:2eac139e942276f4f8d636a65f3c827b5aa5ea930b41c58c89cf38dea38f7f4f","observation_id":"3933642d-9dd2-4752-b265-6342d48170f2","resolution":{"observed_at":"2026-08-16T12:04:22.189694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-08-14T18:47:26.721223Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-16T12:04:21.996731Z","title":"Palm-e: An embodied multimodal language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.996731Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:eadee89d94834dc3680ecbde304a14801a4a3eee968ea88ef9537582cc0d6317","observation_id":"b157a60e-4152-4ce3-a7c7-ecf5d61a146d","resolution":{"observed_at":"2026-08-16T12:04:21.996731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T12:04:21.999919Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:21.999919Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:c966e6a8bd0e0d5f66048c1996436d2a5f7840696ed6670e0437d7fd1005b8c5","observation_id":"899084e8-ec1a-401b-85a4-15adf827ba14","resolution":{"observed_at":"2026-08-16T12:04:21.999919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.177695Z","title":"One pixel attack for fooling deep neural networks,","venue":null,"work_id":"ef0c3c10-60c2-4b4e-b78a-1579c51c018e","year":2019},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:22.002974Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:0492d778b3dd605fcee3d7711247eabded3628968fa72de84dbf140d52acc71e","observation_id":"bdae2b8a-04c6-4e5a-8836-8069d7f44d71","resolution":{"observed_at":"2026-08-16T12:04:22.180578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.169275Z","title":"Deepfool: a simple and accurate method to fool deep neural networks,","venue":null,"work_id":"3f3e949f-d463-437d-9ac2-542c90211319","year":2016},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:22.005905Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:d27481d21b6816cb821ea0783d000dcb1766c08ee2789765a536cc01f1f136b3","observation_id":"660d8dff-3c83-430c-ad11-5056a24ef551","resolution":{"observed_at":"2026-08-16T12:04:22.172184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.160771Z","title":"Tracing the origin of adversar- ial attack for forensic investigation and deterrence,","venue":null,"work_id":"de566286-d28e-40bf-98e7-a14de50ff1f9","year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:22.008900Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:15d1d7b6aa3589d2b10e2162ac509e60f119015eea77987eb6caea4e102f3450","observation_id":"032b371c-ba94-4148-9615-522198b807d9","resolution":{"observed_at":"2026-08-16T12:04:22.163904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.152528Z","title":"The best defense is a good offense: Adversarial augmentation against adversar- ial attacks,","venue":null,"work_id":"774e0a61-f987-42c1-b3d0-b8e7d12b47d3","year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:22.011568Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:1c8f26ce055441fdd864a39f311502734b99d3b7c33f374fa69c8861f69de5ac","observation_id":"8c42b068-ce59-4e1c-9ff1-e9a73ab92709","resolution":{"observed_at":"2026-08-16T12:04:22.155446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.142987Z","title":"Defending against patch-based backdoor attacks on self-supervised learning,","venue":null,"work_id":"f354b6b7-7dfe-43a7-94ce-70d7a2ebfe43","year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:22.015197Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:443ee64584e77ef3d895685f2454a68bf1a78a758d6ff1ce9c57cea59dbc27a2","observation_id":"29fb3b02-01a2-42f7-b213-0f497fc8e75a","resolution":{"observed_at":"2026-08-16T12:04:22.147067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-08-19T07:17:20.004918Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-16T12:04:22.017699Z","title":"Explaining and harnessing adversarial examples,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:22.017699Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:185d6acc25e8e5227ba6b166b3164f8ce80cde00101b42eba0c85ccab732eebd","observation_id":"6a96b7d6-5343-4760-ae65-b0fea024f273","resolution":{"observed_at":"2026-08-16T12:04:22.017699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:04:22.134664Z","title":"Sibling-attack: Rethinking transferable adversarial attacks against face recognition,","venue":null,"work_id":"04822c0a-cf6e-44a7-9635-eac09eeaadc0","year":2023},"citing_paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T12:04:22.020535Z"},"links":{"citing_paper":"/paper/2504.13690"},"observation_digest":"sha256:24cd4c93cfd598459ce799b184963624991aa43e5f159c556048d5f161132aac","observation_id":"fcf6f922-93ae-48b1-ace1-edda92fa1674","resolution":{"observed_at":"2026-08-16T12:04:22.137730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.13690","last_updated":"2025-04-21T17:07:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T12:00:01.212105Z","submitted_at":"2025-04-18T13:46:32Z","title":"Analysing the Robustness of Vision-Language-Models to Common Corruptions"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":23},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 6 inbound Pith citation observations for arXiv:2504.13690."}