{"as_of":"2026-08-10T00:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:38e0d014910bb5237a18077ae88f0458b79113d2b41e81863b5f9e09faf49362","coverage":[{"denominator":299,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T21:10:10.548489Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T04:09:49.764855Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.28551","snapshot_observed_at":"2026-08-04T04:09:49.764855Z","title":"Datacomp-vlm: Improved open datasets for vision-language models.arXiv preprint arXiv:2606.28551,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02589","last_updated":"2026-08-03T17:57:03Z","snapshot_observed_at":"2026-08-08T01:31:36.624827Z","submitted_at":"2026-08-03T17:57:03Z","title":"CAPEval: A Decoupled Caption Evaluation across Understanding and Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T04:09:49.764855Z"},"links":{"cited_paper":"/paper/2606.28551","citing_paper":"/paper/2608.02589"},"observation_digest":"sha256:92cf1d0719fc34e51ee179c66708c7ea0dd92ef1683a1d519b95309733755997","observation_id":"3fb70424-9216-48a8-b94d-89b097a08d86","resolution":{"observed_at":"2026-08-04T04:09:49.764855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.28551/citation-record","integrity":"/paper/2606.28551/integrity","json":"/paper/2606.28551/citation-record.json","paper":"/paper/2606.28551"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.09540","last_updated":"2023-03-22T17:22:35Z","snapshot_observed_at":"2026-08-06T15:07:40.203199Z","submitted_at":"2023-03-16T17:53:24Z","title":"SemDeDup: Data-efficient learning at web-scale through semantic deduplication","version":3},"cited_work":{"arxiv_id":"2303.09540","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.09540","snapshot_observed_at":"2026-07-09T03:05:54.898931Z","title":"SemDeDup: Data-efficient learning at web-scale through semantic deduplication","venue":"cs.LG","work_id":"492d4320-a8d4-4094-b226-ea8d784560d9","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2303.09540","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:c574f855ed696edccf36ce15efae8e2b2a3dc8420291c97400b181969cba2b83","observation_id":"6e93af41-3080-4578-a7da-f416cd7b35bc","resolution":{"observed_at":"2026-07-02T21:17:24.184389Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04578","last_updated":"2024-03-12T10:35:56Z","snapshot_observed_at":"2026-08-08T17:53:54.646922Z","submitted_at":"2024-01-09T14:32:24Z","title":"Effective pruning of web-scale datasets based on complexity of concept clusters","version":2},"cited_work":{"arxiv_id":"2401.04578","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.04578","snapshot_observed_at":"2026-07-02T21:17:24.195093Z","title":"Abbas, E","venue":null,"work_id":"5a7a7243-0c3f-45fa-af92-0073221e40f9","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2401.04578","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:bf685b71d417fb9fd5c40f2c15613103948b2cbdbdc9657911ea9731be9f25a6","observation_id":"1dbb84d9-7d5f-4521-8f1f-2e2488615cc7","resolution":{"observed_at":"2026-07-02T21:17:24.196571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-08-09T11:59:10.408717Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":"2503.01743","doi":"10.18653/v1/2023.wmt-1.23","metadata_source":"pith","pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","venue":"cs.CL","work_id":"83956045-536a-41ff-af02-b80e2a614eab","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:244f910e61800089a8cb6d72f23a98c388f7e4dd528efb716d604250eb5b4ddd","observation_id":"92b8b338-fd0c-46d3-950c-39ef8e11c2d6","resolution":{"observed_at":"2026-07-02T21:17:24.209083Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.987156Z","title":"Acharya, K","venue":null,"work_id":"fad5e76c-5732-46bc-89a1-96abebc3c7a0","year":2019},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:569f7bc904dbd95693f97cc844a861d5bc2b2252383371a61bccb57f5aecb0d9","observation_id":"c9721fb6-9e1c-4c25-8c11-06dcdae83067","resolution":{"observed_at":"2026-07-05T20:01:24.988261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.002755Z","title":"Agnolucci, L","venue":null,"work_id":"4b710454-9f59-45cb-b105-3558bc50bc28","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:b4dfdf62203959bcae6c7ddf7db664b3935de9a757b2ca80c8ce22e87820d4f9","observation_id":"a19966a5-5ef1-4531-aff7-7c132b2c0fc7","resolution":{"observed_at":"2026-07-05T20:01:25.003818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.856981Z","title":"Ainslie, J","venue":null,"work_id":"2af82556-c3c8-4e94-9bdb-83873aa04692","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:cf7b1c36643fd355117b5caefce0846a576e6db00bbad364772a19d90f2ab62e","observation_id":"35187fac-7be8-451f-b041-fcd3754ea30a","resolution":{"observed_at":"2026-07-05T20:01:24.858093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.03264","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T21:00:08.393475Z","title":"arXiv preprint arXiv:2510.03264 , year=","venue":null,"work_id":"b3526143-b2b1-4158-b099-d72b5ed822af","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:a44a895bd266ab1bf5c75a6e2de06b98a8392894b7b43f166c67a041ad9a90cf","observation_id":"7aa4936f-a048-4046-9ebe-68b1217a0253","resolution":{"observed_at":"2026-07-02T21:17:24.218774Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.925589Z","title":"Alayrac, J","venue":null,"work_id":"e6f8dba1-8f37-464e-b2e1-5e1f3748a1c5","year":2022},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:397fbebb315d68c2a21de95ccee60911356d622d73da70b82c88bcf1c6ac0050","observation_id":"88d5015f-3ba6-492c-af90-442eefdc1846","resolution":{"observed_at":"2026-07-05T20:01:24.927086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02737","last_updated":"2025-02-04T21:43:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-04T21:43:16Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","version":1},"cited_work":{"arxiv_id":"2502.02737","doi":"10.48550/arxiv.2502.02737","metadata_source":"pith","pith_arxiv_id":"2502.02737","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SmolLM2: When Smol Goes Big -- Data-Centric Training of a Small Language Model","venue":"cs.CL","work_id":"8472f581-14d4-40f8-8189-62ed8b470c4e","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2502.02737","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:ec55121e9cbb85250b9855e579dd5b9ef8226d51054a90dc2e279390e5ad9841","observation_id":"d7c0c30d-27c1-439b-a705-0de9b654387c","resolution":{"observed_at":"2026-07-02T21:17:24.196896Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T07:19:40.857163+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T07:19:40.857163+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14316","last_updated":"2024-07-16T10:22:51Z","snapshot_observed_at":"2026-08-09T00:44:37.308469Z","submitted_at":"2023-09-25T17:37:20Z","title":"Physics of Language Models: Part 3.1, Knowledge Storage and Extraction","version":3},"cited_work":{"arxiv_id":"2309.14316","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.14316","snapshot_observed_at":"2026-07-04T08:59:42.744162Z","title":"Physics of language models: Part 3.1, knowledge storage and extraction","venue":null,"work_id":"a7f03a83-65ed-495c-9295-ad87e6539976","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2309.14316","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:548b0c9f81c3df4f0043f4d7b5a0ce63dcd0d45be1450789efa3c85e15c467ab","observation_id":"760d78d4-c1c1-4d09-a3b5-52df8b41f577","resolution":{"observed_at":"2026-07-02T21:17:24.222155Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/n19-1245","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MathQA: Towards interpretable math word problem solving with operation-based formalisms","venue":null,"work_id":"b73d762e-5f33-41a0-a44d-b2e613bffd36","year":2019},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:f2cf0794fcfa68bd2a0901e9754f315098d156c8289ad123984bf803ff389f12","observation_id":"57810d9f-af30-46be-8290-53a4d261a0c9","resolution":{"observed_at":"2026-07-02T21:17:23.589184Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-13T22:22:22.182129+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T22:22:22.182129+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23661","last_updated":"2025-12-14T14:18:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-28T05:52:55Z","title":"LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training","version":3},"cited_work":{"arxiv_id":"2509.23661","doi":"10.48550/arxiv.2509.23661","metadata_source":"pith","pith_arxiv_id":"2509.23661","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training","venue":"cs.CV","work_id":"41c2802e-aff9-482f-b506-10955ff0838d","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2509.23661","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:f9faecca950206743222c95f62f46a0db72ddaf9d818143bee877eec4c60ac1a","observation_id":"9b976148-2360-4601-8c58-cad5225c4ca2","resolution":{"observed_at":"2026-07-02T21:17:24.206224Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.817018+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.817018+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20541","last_updated":"2024-05-30T23:50:20Z","snapshot_observed_at":"2026-08-09T09:50:37.523930Z","submitted_at":"2024-05-30T23:50:20Z","title":"Perplexed by Perplexity: Perplexity-Based Data Pruning With Small Reference Models","version":1},"cited_work":{"arxiv_id":"2405.20541","doi":"10.48550/arxiv.2405.20541","metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20541","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Leavitt, and Mansheej Paul","venue":"arXiv (Cornell University)","work_id":"5768fc9f-6021-4f6d-9525-3faad26b7d67","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2405.20541","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:8de6edc6672610b947f0e26a532d604619d289fe887d55b7ca443c6fa0598f5b","observation_id":"dd19a761-50a1-4700-83c2-6c2c5b3407c9","resolution":{"observed_at":"2026-07-02T21:17:24.199460Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.808838Z","title":"Awadalla, L","venue":null,"work_id":"0344f88f-b7da-434d-9d91-83471632a9c4","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:98d2deb68484eafd8baad08037f92fbfb61a1a22d504a342c245e3feab82f91b","observation_id":"4a2ed4ba-a2f3-4e81-aa63-e2713f101d7d","resolution":{"observed_at":"2026-07-05T20:01:24.810010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.16177","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T21:17:24.210394Z","title":"Louis Bethune, David Grangier, Dan Busbridge, Eleonora Gualdoni, Marco Cuturi, and Pierre Ablin","venue":null,"work_id":"253db970-0a8b-4c85-85b9-b762b6ce3086","year":2026},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:f9a27919883064c2e9798d8941e09fa43fe267b1cffe42126f8caf041ce0c1cb","observation_id":"84b509c1-55a7-482a-baae-eb625d641538","resolution":{"observed_at":"2026-07-02T21:17:24.212191Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:8f4f2b6e724a2417ac88e7c036e6ac2209f6040cfb28a5a600a26a1e75391ec9","observation_id":"60179341-d8db-4ec6-aee5-708dfd95b1c7","resolution":{"observed_at":"2026-07-02T21:17:24.225217Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2502.13923","doi":"10.48550/arxiv.2502.13923","metadata_source":"pith","pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-VL Technical Report","venue":"cs.CV","work_id":"69dffacb-bfe8-442d-be86-48624c60426f","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:8742a6c2a12c21705b0f47924114611c57c19a87a87664abc46358ce907313a9","observation_id":"417e579a-6ac5-4336-bdbb-15e06ac79014","resolution":{"observed_at":"2026-07-02T21:17:24.227419Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.864468+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.04937","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T21:17:24.223450Z","title":"Berasi, M","venue":null,"work_id":"f10ac1fc-adc1-4bb5-9f55-2bbfaee95955","year":2026},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:31a9d864e41d9f777b630ccc91318c1a7b7d204d35f37ceae1e75747cb3b2870","observation_id":"661780f2-b57d-4473-b90a-2263d4b3b875","resolution":{"observed_at":"2026-07-02T21:17:24.224911Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.27365","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T21:17:24.226483Z","title":"Le Khac, Sanath Narayan, Wamiq Reyaz Para, and Ankit Singh","venue":null,"work_id":"2fe6e984-1a6a-4446-a95f-ab1d0d54844e","year":2026},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:56ff95d043e33c2f0518cac0990d156560f521c7747374fac1b6a274e3e37981","observation_id":"786015be-ffec-452d-a7ff-8e5cb19e3c93","resolution":{"observed_at":"2026-07-02T21:17:24.228358Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.879928Z","title":null,"venue":null,"work_id":"441df798-f4a9-469b-98b3-bf86f7b693d9","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:dc31253e28bdf654fdf78b70ae627c95d926a575d72ad78a03403d825ac828ed","observation_id":"34fdb3dd-ed02-4667-b007-9dd9c774bfc9","resolution":{"observed_at":"2026-07-05T20:01:24.881034Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07726","last_updated":"2024-10-10T17:28:23Z","snapshot_observed_at":"2026-08-08T07:16:45.596308Z","submitted_at":"2024-07-10T14:57:46Z","title":"PaliGemma: A versatile 3B VLM for transfer","version":2},"cited_work":{"arxiv_id":"2407.07726","doi":"10.48550/arxiv.2407.07726","metadata_source":"pith","pith_arxiv_id":"2407.07726","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaliGemma: A versatile 3B VLM for transfer","venue":"cs.CV","work_id":"df6f48b3-5792-47c7-9614-cb856ea31ad9","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2407.07726","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:c60add9c81f27cee4a85fc043153cecab3061195f75589c44fb6150e3daaaf18","observation_id":"919dbdc0-bc6b-416f-b187-6225b4a60a50","resolution":{"observed_at":"2026-07-02T21:17:24.231016Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:22:31.538292+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.798240Z","title":null,"venue":null,"work_id":"1d6bb9c5-e6c0-48de-afff-1b11bee2c858","year":2019},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:ec404049dd6a9f8fafcf1959c060a2932d1a404e22af0a2ee0f5aaad344e4b68","observation_id":"f0cb20fc-e2e4-4968-9001-a79d08d1197c","resolution":{"observed_at":"2026-07-05T20:01:24.799342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03249","last_updated":"2025-06-16T11:00:21Z","snapshot_observed_at":"2026-07-06T19:27:33.934338Z","submitted_at":"2024-10-04T09:14:11Z","title":"How Much Can We Forget about Data Contamination?","version":4},"cited_work":{"arxiv_id":"2410.03249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.03249","snapshot_observed_at":"2026-07-02T21:17:24.198062Z","title":"How Much Can We Forget about Data Contamination? Proceedings of the 42nd International Conference on Machine Learning (ICML 2025)","venue":null,"work_id":"70a616e0-ec21-4109-98ac-9a05572f4249","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2410.03249","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:68ed1cf7b2064c537991bbeee2a80a8de7403c04fb24d85a51ebd832dc893597","observation_id":"8669fb0f-409e-4772-96fc-699582c30a03","resolution":{"observed_at":"2026-07-02T21:17:24.199652Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.796487Z","title":"Breuel and WebDataset Contributors","venue":null,"work_id":"f6c69fd4-c61a-4cc9-8028-6a23c3a5f406","year":2020},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:be64de0721a29d22335ed97770b06e68360dcee0ce61f9fdd2c7fbae685af7c1","observation_id":"70f1263d-1545-4d23-bf3c-b86c54ab10b5","resolution":{"observed_at":"2026-07-05T20:01:24.797685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.881615Z","title":null,"venue":null,"work_id":"b2f4bb80-e63e-4dd5-a26b-d237cb781a4d","year":1997},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:f2c59474b270b80b1e0f7ec2744769d42a9aeddff88f20e24a51fbbadc8515c5","observation_id":"e1c4e277-2a1f-49a4-96a5-4a98cd2c6f33","resolution":{"observed_at":"2026-07-05T20:01:24.882725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.839865Z","title":"Cahyawijaya, H","venue":null,"work_id":"ea3dfa5e-b70b-4e24-8f54-ec588ce8695b","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:012e6142cccbe96edee1f601a21bf2c66081be064fd4d4b017d6cadc86f05eab","observation_id":"27096540-c382-4909-a9a6-c09bfda33a23","resolution":{"observed_at":"2026-07-05T20:01:24.840995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.876264Z","title":"Cao and J","venue":null,"work_id":"02937fc9-10e8-4fcb-9f12-5907ab1f649f","year":2022},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:3d79101351b5ca13c65262f814a929246b4ae252a641dd2c89a38922267edb88","observation_id":"b28904d8-093d-42e9-b5b0-18326859e04a","resolution":{"observed_at":"2026-07-05T20:01:24.877586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.846564Z","title":"Carlini, D","venue":null,"work_id":"901d2988-0e95-47b2-81a3-e9dacb701d2d","year":2022},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:279289c082627eeadb762cdaab7dd2e1ad5a16b862e628c26281952de06d6b39","observation_id":"9656a82b-aa32-4516-b14c-beec3e55b167","resolution":{"observed_at":"2026-07-05T20:01:24.847679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.994256Z","title":null,"venue":null,"work_id":"4aeef47b-6e7b-4074-b95c-48ea3c50d676","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:7b88dcdf4bd4e4c82f2da97bb6d8ce8b1cca972456c07559e318a3deb8c17176","observation_id":"bf1fb155-8ee7-4788-8d64-4f9e02f876a7","resolution":{"observed_at":"2026-07-05T20:01:24.995342Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.08545","last_updated":"2022-11-15T22:31:38Z","snapshot_observed_at":"2026-08-09T22:32:24.524992Z","submitted_at":"2022-11-15T22:31:38Z","title":"MapQA: A Dataset for Question Answering on Choropleth Maps","version":1},"cited_work":{"arxiv_id":"2211.08545","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.08545","snapshot_observed_at":"2026-07-02T21:17:24.219845Z","title":"MapQA: A dataset for question answering on choropleth maps","venue":null,"work_id":"6e611921-6f4e-4ace-8a5f-5589c4c99bb9","year":2022},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2211.08545","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:443ecbabcc6f89e85b45aca23ddbcfd2a0c1c962ce1cf6ec4a7d21067174a50a","observation_id":"a9a59111-5442-4dce-a9fe-cf8faa980881","resolution":{"observed_at":"2026-07-02T21:17:24.222935Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.850004Z","title":"Changpinyo, P","venue":null,"work_id":"12375103-2798-4890-8b71-8c0126431d8b","year":2021},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:d9de730ffc11a6db10a7c31164a8c8a159f2b39ba467aaa0f7496fd4f642d165","observation_id":"fb48b3f6-02de-4cb2-bfad-18fec1c71b60","resolution":{"observed_at":"2026-07-05T20:01:24.851123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11684","last_updated":"2024-06-17T07:55:59Z","snapshot_observed_at":"2026-07-06T17:31:53.996417Z","submitted_at":"2024-02-18T19:26:49Z","title":"ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models","version":2},"cited_work":{"arxiv_id":"2402.11684","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.11684","snapshot_observed_at":"2026-07-10T17:07:25.737454Z","title":"ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models","venue":"cs.CL","work_id":"4cf5f4e3-c59a-4ccb-a655-563157a9ce74","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2402.11684","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:b05c44d7dc85bdae9d6bfc7a22359fe91630c3b00e61f46fac4dbb1704a43fcf","observation_id":"6d30b0ad-a591-435d-953b-7ea19ac1832f","resolution":{"observed_at":"2026-07-02T21:17:24.218321Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.028657Z","title":null,"venue":null,"work_id":"ca067642-1f9d-44b8-9a1d-ca586775ddc6","year":2022},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:ca12b12608c1151694502651a001a2ccb4a9f86f741bccbe16c52a30e241d968","observation_id":"cb59312b-568b-4db8-a103-08933619a761","resolution":{"observed_at":"2026-07-05T20:01:25.029700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.961708Z","title":null,"venue":null,"work_id":"f4676dc4-e202-4a50-a24c-2031a66090d1","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:e3185e6b35cdc99669c6b3ef038312c35ca90ad8e9005c2a5813a775050ef1ea","observation_id":"beef3e49-aa6a-41c9-856e-d18e04d87460","resolution":{"observed_at":"2026-07-05T20:01:24.962838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.972197Z","title":null,"venue":null,"work_id":"3bcc5fd8-7380-4f35-92c5-f55b14fc9399","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:d82e3dd209f02035a43774a9ebc619a2405b9b90ab35343cef24c77ff1b30717","observation_id":"5323987d-1522-4440-8f20-ef3705b929f9","resolution":{"observed_at":"2026-07-05T20:01:24.973266Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:b30e8283aac389e3af5d8f4ede4b80040c9ebb7dfc0380937a522ac206cf70b3","observation_id":"7899606d-f6bc-4a54-a636-b5bad062d6ab","resolution":{"observed_at":"2026-07-02T21:17:23.903267Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.12237","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:58:46.720692Z","title":"arXiv preprint arXiv:2602.12237 , year=","venue":null,"work_id":"2fcf1d83-43dc-487a-b86b-0be8003af640","year":2026},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:d3727ae0a28eec8a6780ac78a211ac67c86fe2caa7762185c502f109a4111e94","observation_id":"0daac061-3bac-4b38-b46f-63ecbed1da60","resolution":{"observed_at":"2026-07-02T21:17:24.031180Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.886733Z","title":null,"venue":null,"work_id":"c314c5b4-8346-4908-bbd8-a9430a74bc7a","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:e49577c79952c1e52ebeb19045f4781a30318e1210174b3d1150bdcb1c000e29","observation_id":"7bf8825d-b14a-4ba6-b3c8-220beb2b887e","resolution":{"observed_at":"2026-07-05T20:01:24.887864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.00325","last_updated":"2015-04-03T20:21:16Z","snapshot_observed_at":"2026-08-04T18:05:27.145522Z","submitted_at":"2015-04-01T18:13:43Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","version":2},"cited_work":{"arxiv_id":"1504.00325","doi":"10.48550/arxiv.1504.00325","metadata_source":"pith","pith_arxiv_id":"1504.00325","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Microsoft COCO Captions: Data Collection and Evaluation Server","venue":"cs.CV","work_id":"b3d6fb46-4169-4a28-8f7e-2ca6774211da","year":2015},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/1504.00325","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:21e48906262cb62efe0c8bdddb3c966ab54b264204b5c97193aecd5989b65cbf","observation_id":"8545cc04-a8bd-481b-a9e0-0cb918d0dbcf","resolution":{"observed_at":"2026-07-02T21:17:24.158886Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.834747Z","title":null,"venue":null,"work_id":"291bd2eb-a8f0-415b-9075-bd02ce7f814d","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:099e3dab8475a28b40ed8019823a9135d24fbc985a0e537d5918badf1da11c48","observation_id":"170a5d6c-2b23-4094-9e14-38e8094149c6","resolution":{"observed_at":"2026-07-05T20:01:24.835752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":"2412.05271","doi":"10.48550/arxiv.2412.05271","metadata_source":"pith","pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","venue":"cs.CV","work_id":"ee70bdc8-4656-4849-ada7-ce42a2278d70","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:d426cfba14a39a0c46154b94b2119efcc1c09ba9426637e802d842a909666e44","observation_id":"ca29f30a-af17-41df-a2dc-3397d8529791","resolution":{"observed_at":"2026-07-02T21:17:24.155917Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:16.919385+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:16.919385+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.966874Z","title":null,"venue":null,"work_id":"3a997b53-66a9-449e-b050-9403066a00a6","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:e11015cd74997b01119db6dd2fc5c86ecef63ed1fe38b7d88d5648522f9a76dd","observation_id":"98048545-6f73-44d9-9381-16acfa803ead","resolution":{"observed_at":"2026-07-05T20:01:24.967960Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.773371Z","title":null,"venue":null,"work_id":"44568f1d-5243-4b75-b1f1-01054936fd15","year":2019},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:d89d55cff9834fc864935f984a96241a0bfd41135fb1d00d653570b0d1abe362","observation_id":"840141e3-04e7-4d2b-8350-355c8dc16d54","resolution":{"observed_at":"2026-07-05T20:01:24.774560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13180","last_updated":"2025-07-23T19:22:35Z","snapshot_observed_at":"2026-08-07T23:47:53.537198Z","submitted_at":"2025-04-17T17:59:56Z","title":"PerceptionLM: Open-Access Data and Models for Detailed Visual Understanding","version":3},"cited_work":{"arxiv_id":"2504.13180","doi":"10.48550/arxiv.2504.13180","metadata_source":"arxiv_reference","pith_arxiv_id":"2504.13180","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Perceptionlm: Open-access data and models for detailed visual understanding","venue":"ArXiv.org","work_id":"e81d25ef-bd13-473f-8fc5-0cf3dc3af528","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2504.13180","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:58670cc46277aee51b03da82f56f61c052b8bfec43fe9ff300295a5ab9167df1","observation_id":"115430e1-3ed7-4c6d-be2e-554e0056aa28","resolution":{"observed_at":"2026-07-02T21:17:24.161656Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.10611","last_updated":"2026-04-02T16:01:02Z","snapshot_observed_at":"2026-08-02T06:45:30.387180Z","submitted_at":"2026-01-15T17:27:44Z","title":"Molmo2: Open Weights and Data for Vision-Language Models with Video Understanding and Grounding","version":4},"cited_work":{"arxiv_id":"2601.10611","doi":"10.48550/arxiv.2601.10611","metadata_source":"pith","pith_arxiv_id":"2601.10611","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Molmo2: Open Weights and Data for Vision-Language Models with Video Understanding and Grounding","venue":"cs.CV","work_id":"f0dc2969-bd90-4a5d-81df-d557352690b6","year":2026},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2601.10611","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:7a77002852ac177499385e6012e2253797619160f8a49baf49a949fa7b8ca796","observation_id":"5e1aa486-8110-4749-93f2-469f182bb37f","resolution":{"observed_at":"2026-07-02T21:17:24.130067Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:7feedb38dc125863dbb9037613520efa0e9c9ec166aa1cf596d025865ed73f9b","observation_id":"23750341-1bda-435a-be39-5c9e75df0413","resolution":{"observed_at":"2026-07-02T21:17:24.121375Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.775160Z","title":"Conover, M","venue":null,"work_id":"9cce429c-de77-481b-928d-efe34f3500c2","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:bfee2a397a89389f2299a69ba22eb93cf93409cb5f7537e484ea4a40c9f79121","observation_id":"e015c339-d7d9-48c9-968f-2334fe51fc04","resolution":{"observed_at":"2026-07-05T20:01:24.776347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.787566Z","title":"Contributors","venue":null,"work_id":"ddbb27c4-4f7e-4c88-b267-ff714255904f","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:c24043eb6e584db3165dc2e253fd40709df0fef17753adda2024fe69c5252c6b","observation_id":"026175f3-87f4-493c-82a1-e5ddb31e0600","resolution":{"observed_at":"2026-07-05T20:01:24.788677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":"2207.04672","doi":"10.18653/v1/w19-5207","metadata_source":"pith","pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","venue":"cs.CL","work_id":"68c8336c-d20e-40fa-ba9c-89459da6fc1a","year":2022},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:d5069cc4b43c1e54851d98bd0116a6cf018bbf48dc39520881824632fb9fed79","observation_id":"ef6d4e3a-24ec-4e7a-a19e-37be794217a0","resolution":{"observed_at":"2026-07-02T21:17:24.174216Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.789249Z","title":null,"venue":null,"work_id":"9097c734-f0d4-43f5-9c8e-c6789dcba594","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:62c9fb7b05c2d28ea924f977a644cd1c20e68331c84d96f32e791881fbc03eb3","observation_id":"5db8b838-809f-4d58-bc3f-eacb7cf92332","resolution":{"observed_at":"2026-07-05T20:01:24.790326Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.828135Z","title":null,"venue":null,"work_id":"e874b567-733e-49db-9666-e7544891d43d","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:6729d4a34341bf3d772e6afd421bccf11eb39ad3daab8bcfc8b56e68be6506d6","observation_id":"dded3567-3014-47f6-a7d1-af4ba708e4cf","resolution":{"observed_at":"2026-07-05T20:01:24.829229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08515","last_updated":"2024-07-12T01:19:33Z","snapshot_observed_at":"2026-08-02T05:39:29.403958Z","submitted_at":"2024-07-11T14:00:14Z","title":"15M Multimodal Facial Image-Text Dataset","version":2},"cited_work":{"arxiv_id":"2407.08515","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.08515","snapshot_observed_at":"2026-07-02T21:17:24.132233Z","title":"15m multimodal facial image-text dataset","venue":null,"work_id":"a391bd78-8a67-4418-9a5d-ab57d9832e05","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2407.08515","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:87c778bed087208d8931135842cd84b69f32ca61cb66ff851f95b0e6faba7c56","observation_id":"99c1a564-1d17-4dd2-82c3-b3b2f517d658","resolution":{"observed_at":"2026-07-02T21:17:24.134239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":"2307.08691","doi":"10.48550/arxiv.2307.08691","metadata_source":"pith","pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","venue":"cs.LG","work_id":"fff3953b-5efb-4753-bee4-002f59995810","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:a481eef9784fa810d658896c4d6f0441b033b9ef1c76c1ffeaaf3fce6a7a6fe7","observation_id":"e09ba44f-1768-442f-b750-c94c0d3b9e28","resolution":{"observed_at":"2026-07-02T21:17:24.117417Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:50:18.243793+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:50:18.243793+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.022185Z","title":null,"venue":null,"work_id":"8c411a9f-4a10-49be-b4aa-eeffd675ed6e","year":2017},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:6bb4d0cb820107221ea31151d710cc90f863327ddd8d76f7a0d79a0cfd44be09","observation_id":"7f37429b-8b2f-4a32-9d5e-86b3c555915c","resolution":{"observed_at":"2026-07-05T20:01:25.023224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.977192Z","title":null,"venue":null,"work_id":"a2aa5640-d947-4881-8443-307240a96e4c","year":2012},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:cd81e6730c5c8211d5515faf24038439cdf2e748e92ac2884ecd7c58e60bf99e","observation_id":"5225a508-80ea-45b0-8b0c-5523c5b5f6a7","resolution":{"observed_at":"2026-07-05T20:01:24.978289Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.975499Z","title":"Deitke, C","venue":null,"work_id":"efd909ee-b76c-4e84-919f-78435f069b58","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:bbc59f0a78822416fba36f0016c83bf8da8c90ea2213c4dd5f4d3830cfe1d910","observation_id":"dcb6196b-81d9-4d38-9eb5-5f5d17f1b789","resolution":{"observed_at":"2026-07-05T20:01:24.976604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.03929","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T15:59:57.285345Z","title":"Nvidia nemotron nano v2 vl","venue":null,"work_id":"e25756fb-c8f2-4de6-abac-4e4adf159bc0","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:3e76ab78c90bc5b41dcd3899e8b1ebb18aa0160ff36ff89ea491eb318d088ff4","observation_id":"488df6a1-06c1-4ad8-91db-b5c21bc98270","resolution":{"observed_at":"2026-07-02T21:17:24.126968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13161","last_updated":"2025-11-30T07:03:40Z","snapshot_observed_at":"2026-08-08T11:46:20.080583Z","submitted_at":"2025-04-17T17:58:13Z","title":"Nemotron-CLIMB: CLustering-based Iterative Data Mixture Bootstrapping for Language Model Pre-training","version":2},"cited_work":{"arxiv_id":"2504.13161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.13161","snapshot_observed_at":"2026-07-09T02:55:53.506375Z","title":"Nemotron-climb: Clustering-based iterative data mixture bootstrap- ping for language model pre-training","venue":"cs.CL","work_id":"412269c2-ec20-4706-8440-3bb6773c3fc0","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2504.13161","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:5cb78dccda9fee625b512de35ad5e09236d87981cfd5ef8a58435d82eed39e84","observation_id":"3174a4f9-0bbf-4627-9b98-2d542c685c72","resolution":{"observed_at":"2026-07-02T21:17:23.908958Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.980468Z","title":null,"venue":null,"work_id":"0be51dcf-af0e-4dbb-9a5c-b0da3bcb4cfe","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:1ab1dd47d9c36421f6de01671ec379c3f73e8f7d4056aceabc5895898da16e4e","observation_id":"9650f10a-f78a-4696-a656-37ff6b1cefe7","resolution":{"observed_at":"2026-07-05T20:01:24.981525Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.990533Z","title":"Dodge, M","venue":null,"work_id":"a1016b82-4a8a-47c6-9579-3fba02345ff2","year":2021},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:37d7196cf604c2e5fa405e87fc2f45af63a9ef0fec09d09d7d5bea6445034991","observation_id":"787ce73d-d622-42d3-91e6-510e764315d8","resolution":{"observed_at":"2026-07-05T20:01:24.991988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":"2010.11929","doi":"10.1175/jcli-d-22-0357.1","metadata_source":"pith","pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","venue":"cs.CV","work_id":"e96730e3-129b-4db6-b981-15ab7932e297","year":2020},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:9ea641128fba9a89d7030e074dcc400c03d6b4bc4506e63274e78c851bc83412","observation_id":"c5210e19-1062-4daf-8855-be439cea0dfc","resolution":{"observed_at":"2026-07-02T21:17:24.098727Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.838108Z","title":"Douze, A","venue":null,"work_id":"228ff5e1-2dd4-47a4-8392-f308b3106960","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:deb34f18aacd344dd6dbe99379eae31b2d465c156ff85bc3b57e52142fe2a822","observation_id":"72c965fe-2ba9-4c4b-9c41-c01cf610aaa7","resolution":{"observed_at":"2026-07-05T20:01:24.839270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.965138Z","title":null,"venue":null,"work_id":"a1271f5c-8207-4bf2-a566-6c3cfebd8e96","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:46b0f0af785b6e4a73ee03eee75a5ca2dce770e0efe5ccfcdf455649a96cc5ad","observation_id":"065125d0-77a2-43f9-845b-c54055b00c67","resolution":{"observed_at":"2026-07-05T20:01:24.966297Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.769597Z","title":"Evans, N","venue":null,"work_id":"23268247-5614-46c4-81c6-8412f124e6a4","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:2208d91c03c2bff559aa4b56a5f02f13d1e67d361c26425d0c76f0bfbf88d1f5","observation_id":"097cf026-92c4-4e89-887c-98796734d68e","resolution":{"observed_at":"2026-07-05T20:01:24.770851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.771510Z","title":null,"venue":null,"work_id":"ee44e2e1-fc09-412f-bef1-24e5caf0f312","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:8688ab316df4151216f9ad1d7f834f0e454c7afc02d5a6532fae4bc67fe50556","observation_id":"206e2812-4b02-4134-b712-e7f4245c5dca","resolution":{"observed_at":"2026-07-05T20:01:24.772769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.952581Z","title":null,"venue":null,"work_id":"85ecfeeb-8c3b-43f7-8c93-551bd375a256","year":2022},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:9ed92f2a816b9b321ea391a2aada36c92505cf28dcac429dfb8c968a17c8a4ab","observation_id":"3bf946f2-bea8-4367-9c5a-623e43bc7b8b","resolution":{"observed_at":"2026-07-05T20:01:24.953749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17425","last_updated":"2023-11-06T02:47:51Z","snapshot_observed_at":"2026-07-06T16:25:38.571377Z","submitted_at":"2023-09-29T17:37:29Z","title":"Data Filtering Networks","version":3},"cited_work":{"arxiv_id":"2309.17425","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.17425","snapshot_observed_at":"2026-07-04T20:50:12.674098Z","title":"arXiv preprint arXiv:2309.17425 (2023)","venue":null,"work_id":"9922937e-9c54-4233-8816-d729dfaf746e","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2309.17425","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:93d92171fc8a9d6bec2447fdffe3bce7fd52daf64ba1d20dca3acaf2c66ab05d","observation_id":"8698bd1a-56b9-4f3f-a178-ec649158660b","resolution":{"observed_at":"2026-07-02T21:17:24.102960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.07879","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T14:48:32.732886Z","title":"IFBench: Granular Instruction-Following Evaluation,","venue":null,"work_id":"5556d273-4dc2-495d-84b7-3d8cd50465d3","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:33f07579c8cbea9543fbb5f1da7545663521a2419c50d636fe20647caa58ba11","observation_id":"1fb8cf54-58f4-4bde-8735-f107a5d33d0f","resolution":{"observed_at":"2026-07-02T21:17:23.852571Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.12705","last_updated":"2026-05-12T20:08:00Z","snapshot_observed_at":"2026-08-06T21:05:32.361086Z","submitted_at":"2026-05-12T20:08:00Z","title":"Early Data Exposure Improves Robustness to Subsequent Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2605.12705","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.12705","snapshot_observed_at":"2026-07-02T21:17:24.084384Z","title":"Early Data Exposure Improves Robustness to Subsequent Fine-Tuning","venue":"cs.LG","work_id":"8e9a1577-68c8-4287-886d-632d224bea88","year":2026},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2605.12705","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:59c91fd9f9a107fd5331baf2199c69d46a55d625cf24e67b9e27784c8061c2b0","observation_id":"e671bb30-5f82-44ca-a0ea-ac72abea6cb3","resolution":{"observed_at":"2026-07-02T21:17:24.085681Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13394","last_updated":"2025-10-24T02:45:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T09:22:36Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","version":5},"cited_work":{"arxiv_id":"2306.13394","doi":"10.48550/arxiv.2306.13394","metadata_source":"pith","pith_arxiv_id":"2306.13394","snapshot_observed_at":"2026-07-10T13:27:05.561984Z","title":"MME: A Comprehensive Evaluation Benchmark for Multimodal Large Language Models","venue":"cs.CV","work_id":"806d2e73-71b3-4d56-87e0-39d571cc15d6","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2306.13394","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:a24cec4385c3cd8f30f528040cdba4da0749ab0300c87f1f7fc857d6633f18cc","observation_id":"478bdd4f-b1cd-4963-8565-356f63378af7","resolution":{"observed_at":"2026-07-02T21:17:24.083029Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-08T16:08:17.033703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T16:08:17.033703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.081510Z","title":null,"venue":null,"work_id":"a90ae6c9-abaa-4664-8b7b-5c164f3e5e8c","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:7b8b0b4080c3b10e39310762ec37f6ca3d9ecaa399b151f0c58d000f4c737172","observation_id":"dbdc4178-2341-4dad-8bee-dfaf3fc61570","resolution":{"observed_at":"2026-07-05T20:01:25.082520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.983770Z","title":null,"venue":null,"work_id":"4e918e54-1197-4abb-ae98-f7a99f88822a","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:b43f0c81565681dceab7131639efef5186b9679eafe7db92512febb45b11ccdd","observation_id":"3d7d2e3d-741f-4095-9489-217dccf728fa","resolution":{"observed_at":"2026-07-05T20:01:24.984850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00698","last_updated":"2021-10-06T23:28:47Z","snapshot_observed_at":"2026-08-06T22:52:01.310042Z","submitted_at":"2021-09-02T04:02:51Z","title":"An Empirical Exploration in Quality Filtering of Text Data","version":2},"cited_work":{"arxiv_id":"2109.00698","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2109.00698","snapshot_observed_at":"2026-07-02T21:17:24.089869Z","title":null,"venue":null,"work_id":"9f5cc2a6-78b2-40d0-b28b-480273e4bcde","year":2021},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2109.00698","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:668a600ae52d6a846e3c4bf705067c3b4a1c51c8f79a75b163e2c2965a4cd4f4","observation_id":"c2cf936d-974f-40b9-a620-7dd49e7ba1a0","resolution":{"observed_at":"2026-07-02T21:17:24.091470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":"2101.00027","doi":"10.1117/1.jmi.10.6.061104","metadata_source":"pith","pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","venue":"cs.CL","work_id":"9b10667a-da61-4358-aceb-10578234d45d","year":2020},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:9ea58d485ab919a9168aab4115f4ce96a6514d4f5913d6a5d6fd789bf0abfdb7","observation_id":"fe8eec3c-9204-4b21-937a-7aaecc94be4a","resolution":{"observed_at":"2026-07-02T21:17:24.108289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1896.373743","doi":"10.1145/3711896.3737431","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gervais, A","venue":null,"work_id":"35cfd6db-ee6d-417f-a3b2-a0cc49db1a23","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:a03976489cb0ddc9567b1856aae09cacb81fa483bc3e5c5b09be4bb0963ecd29","observation_id":"7f36c8f0-1de8-488e-b008-af41948273aa","resolution":{"observed_at":"2026-07-02T21:17:23.583007Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03864","last_updated":"2024-03-13T00:50:05Z","snapshot_observed_at":"2026-07-06T17:40:33.769700Z","submitted_at":"2024-03-06T17:15:04Z","title":"Are Language Models Puzzle Prodigies? Algorithmic Puzzles Unveil Serious Challenges in Multimodal Reasoning","version":3},"cited_work":{"arxiv_id":"2403.03864","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.03864","snapshot_observed_at":"2026-07-02T23:57:28.174414Z","title":"Are language models puzzle prodigies? algorithmic puzzles unveil serious challenges in multimodal reasoning","venue":null,"work_id":"17099be9-57d0-467a-b0b8-95c012222de9","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2403.03864","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:ca2166a1e715dcd6b03d11713981fcc1571c4f4637336313170e4d1994bab470","observation_id":"76545fc9-79ce-4d5a-a984-df179e950359","resolution":{"observed_at":"2026-07-02T21:17:24.041612Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.041987Z","title":"Ghosh, S","venue":null,"work_id":"ee37e29f-40b2-4054-9028-66bfc5c51cac","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:7d94027540fe882c035bbb7cc50dec49ad50bb8ee2955382512d3e4b634c317f","observation_id":"3b74c3f4-1126-41b3-b0d0-d9191f1757a6","resolution":{"observed_at":"2026-07-05T20:01:25.043009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.20643","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T21:17:24.040519Z","title":"Ghosh, V","venue":null,"work_id":"a698c022-faa1-4735-93ac-a6555c6ab27b","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:0b7ae6204f04e6140060a932af171b5f6f8d5fe577100af610414bd58a14e724","observation_id":"7fac60a4-3afe-41f0-8141-1365878c0313","resolution":{"observed_at":"2026-07-02T21:17:24.042268Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.947233Z","title":"Glaive-Code-Assistant, 2023","venue":null,"work_id":"731a0fae-1089-474b-8062-3f1f81b8e028","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:ab7a8894edf91642c61773e398f297dfabc75ed27298dd4faa2d739e90d02d10","observation_id":"a132b836-e819-49b8-bb20-d1ed4a61c2bd","resolution":{"observed_at":"2026-07-05T20:01:24.948452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.023765Z","title":"Goyal, P","venue":null,"work_id":"43ac996e-a69f-481e-a859-2428a3f2ddd1","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:a077331197d92e8cfdbc57b320c60e6bf8002ab7d0a09bd35088704902634611","observation_id":"8e38464e-b58d-4cda-9c82-860092200afa","resolution":{"observed_at":"2026-07-05T20:01:25.024815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.776998Z","title":"Goyal, T","venue":null,"work_id":"0f407a60-1178-4153-9d0b-5e22b4c073cd","year":2017},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:36c6a585fea260450468cfef74e9ce5e1d288cf6d7b778533d3efd4b61866c8d","observation_id":"df863e2f-403a-4d42-a3b0-56c1fc610f98","resolution":{"observed_at":"2026-07-05T20:01:24.778212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:e156fd829325e55cfceaa605e76ca8f6f1620d5c177da74c77678cc58400a3d3","observation_id":"16612208-c915-4752-9789-33d4066ac477","resolution":{"observed_at":"2026-07-02T21:17:24.044845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.934526Z","title":null,"venue":null,"work_id":"ec665adb-5a2a-4cfa-ab41-1b31caca7b03","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:058f902b04aa6273569a234260f233e88e0c2bfad5bba949df8c765f28b19c28","observation_id":"ab05b996-0e13-418e-81e6-69e9b34831f7","resolution":{"observed_at":"2026-07-05T20:01:24.935664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.043573Z","title":null,"venue":null,"work_id":"c82d8d22-8717-454d-9f20-53c24de9a444","year":2024},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:c82c2f1fe8e2f4ae692d65f45252986f466d07b1be5b70d6679e87e0bbae2c6c","observation_id":"231b05a2-f2f3-48ab-84f6-401741e2eb3b","resolution":{"observed_at":"2026-07-05T20:01:25.044667Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04178","last_updated":"2025-06-05T02:21:52Z","snapshot_observed_at":"2026-08-09T02:57:31.005115Z","submitted_at":"2025-06-04T17:25:39Z","title":"OpenThoughts: Data Recipes for Reasoning Models","version":2},"cited_work":{"arxiv_id":"2506.04178","doi":"10.48550/arxiv.2506.04178","metadata_source":"pith","pith_arxiv_id":"2506.04178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenThoughts: Data Recipes for Reasoning Models","venue":"cs.LG","work_id":"c7acbe41-27a0-4773-a7be-8f08d86cdf21","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2506.04178","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:2d56f518f6aecd8012e214be58704daf141b0233b26b73920ce91a0415890f80","observation_id":"fd1c174c-5f95-4e6a-84d8-91bc27a2438f","resolution":{"observed_at":"2026-07-02T21:17:24.048261Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-05-23T10:52:48.169741+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T10:52:48.169741+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07062","last_updated":"2025-05-11T17:28:30Z","snapshot_observed_at":"2026-08-02T16:13:31.498470Z","submitted_at":"2025-05-11T17:28:30Z","title":"Seed1.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":"2505.07062","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07062","snapshot_observed_at":"2026-07-08T16:15:06.198778Z","title":"Seed1.5-VL Technical Report","venue":"cs.CV","work_id":"0e8e025f-ca1e-49cc-aee2-33f3a0201f3c","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2505.07062","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:48e56e917ee6ad40d4601cfd424f9ecbf1d558fa32e2a81a64ae26c64d8e623c","observation_id":"e3428f63-441f-4269-99f9-19fa13808946","resolution":{"observed_at":"2026-07-02T21:17:24.091463Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.014138Z","title":null,"venue":null,"work_id":"9216dfbc-7c51-4f3c-a052-892a2966a231","year":2019},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:c6a9c9b959656027661348fdcb73e43225aa52f51a8b6d8e323ecbb42dabfaf0","observation_id":"66e6f1e6-52e1-40b0-ba10-3b585ea52f8e","resolution":{"observed_at":"2026-07-05T20:01:25.015161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.040344Z","title":null,"venue":null,"work_id":"9354b78d-4e49-4fa8-b729-a21346bf5a4f","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:9fd74f0c4ed6159b6786abca3daeae4d30fade3c1b7af0475fb02dbe43cf4256","observation_id":"75843850-55d1-439a-80dc-688e9e893a65","resolution":{"observed_at":"2026-07-05T20:01:25.041448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.015787Z","title":"Gupta, A","venue":null,"work_id":"34c9fe6e-332f-4a77-9a4d-d1bdccbbfe34","year":2016},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:821b990e8e10e593ffce521069dfce86946504c79eb23639250c7827c6fef545","observation_id":"c993d1ea-6d58-4fd2-afdb-b45f869e21cc","resolution":{"observed_at":"2026-07-05T20:01:25.016910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.057175Z","title":"Gurari, Q","venue":null,"work_id":"ec74ee17-773a-4b45-bdb7-c9c0bab5c855","year":2018},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:456c50a38f86b243a0d7298cdd7af89c993965b8a5385c4ffb1adb54c6dadd30","observation_id":"386c077e-ac45-47bf-8a86-2dc4cb51c76b","resolution":{"observed_at":"2026-07-05T20:01:25.058272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16483","last_updated":"2023-11-27T15:20:23Z","snapshot_observed_at":"2026-08-06T14:11:19.997270Z","submitted_at":"2023-11-27T15:20:23Z","title":"ChartLlama: A Multimodal LLM for Chart Understanding and Generation","version":1},"cited_work":{"arxiv_id":"2311.16483","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.16483","snapshot_observed_at":"2026-07-07T19:34:06.392258Z","title":"Chartllama: A mul- timodal llm for chart understanding and generation","venue":"cs.CV","work_id":"f6c4f1ff-0ce7-47e8-82e5-5c24c2a3ed9f","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2311.16483","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:5414b0449d1f50906140966ce736072913f4ad9de21e042d5b691607cffc176d","observation_id":"7643d279-951d-42b0-8d9b-e6dcafb71e32","resolution":{"observed_at":"2026-07-02T21:17:24.078675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:25.053603Z","title":"Hanu and Unitary team","venue":null,"work_id":"51c596de-2ee4-42ec-9c1e-6b8d207a6f5d","year":2020},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:dfa9757869aebc30559563a142582771cae787b6a76c2dad25c4d3ebe8d3cebf","observation_id":"6d6c1834-3211-407a-9c86-935bbd2ffb7d","resolution":{"observed_at":"2026-07-05T20:01:25.054745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10755","last_updated":"2023-09-15T09:52:14Z","snapshot_observed_at":"2026-07-06T16:08:33.160103Z","submitted_at":"2023-08-21T14:40:48Z","title":"WanJuan: A Comprehensive Multimodal Dataset for Advancing English and Chinese Large Models","version":3},"cited_work":{"arxiv_id":"2308.10755","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.10755","snapshot_observed_at":"2026-07-02T22:17:25.674418Z","title":"Wan- juan: A comprehensive multimodal dataset for advancing english and chinese large models","venue":null,"work_id":"9ad40732-9366-4664-8ff4-660de173e5fd","year":2023},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2308.10755","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:35326d816ead49e358a672fced95d833785e95b55486d54e94bae6c05433feba","observation_id":"e9f6c4f1-71e5-415e-9bc6-f65b012bfcca","resolution":{"observed_at":"2026-07-02T21:17:24.114264Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.988850Z","title":null,"venue":null,"work_id":"50cc2296-5321-4c29-8e97-1f356d15e3ff","year":2018},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:3a080e77f8e6830339bb572663fb31eb5608a77a774cff0c74b81a65f807750b","observation_id":"a75e9af8-31b5-43a3-9e71-a4debd4b2aff","resolution":{"observed_at":"2026-07-05T20:01:24.989980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10286","last_updated":"2020-03-07T17:55:41Z","snapshot_observed_at":"2026-07-06T09:06:42.071993Z","submitted_at":"2020-03-07T17:55:41Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2003.10286","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.10286","snapshot_observed_at":"2026-07-10T18:57:31.568292Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","venue":"cs.CL","work_id":"4e35c15f-5a72-4a89-a773-9d4036871506","year":2020},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2003.10286","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:f4f9f9da99ff5621eaed212c0936640c1d212df5b65bafbaae4d25f09e1ccbc3","observation_id":"4ffc4dcf-9c0c-454b-add9-9872b245103d","resolution":{"observed_at":"2026-07-02T21:17:23.952660Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13144","last_updated":"2025-08-18T17:56:04Z","snapshot_observed_at":"2026-08-05T19:06:25.181949Z","submitted_at":"2025-08-18T17:56:04Z","title":"Signal and Noise: A Framework for Reducing Uncertainty in Language Model Evaluation","version":1},"cited_work":{"arxiv_id":"2508.13144","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.13144","snapshot_observed_at":"2026-07-02T23:47:27.665680Z","title":"Signal and noise: A framework for reducing uncertainty in language model evaluation.arXiv preprint arXiv:2508.13144, 2025","venue":null,"work_id":"79b5341a-c36a-445b-9ae3-4c9b795c213a","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2508.13144","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:e8f90200cf4c86ef5cbdb12f331c9bfc6a34787df40ae163cd0666037399b6ab","observation_id":"cb4686b8-c5f2-4d3c-b97c-306c93e5f914","resolution":{"observed_at":"2026-07-02T21:17:24.071487Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-09T10:28:06.906299Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:6ab869a079cfcbccfe561a63c17f2cdacaf9f037bca05ee1ba93352d3101615e","observation_id":"aeeecf78-24f6-47d4-83d8-9f20fa2bf562","resolution":{"observed_at":"2026-07-02T21:17:24.102803Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:e1d9632b8456217bef2db22cd53724f2b6deba4ce31dd3d19adb5ebba1f5c84a","observation_id":"d62847b9-4d8f-487b-97da-08357da10f24","resolution":{"observed_at":"2026-07-02T21:17:24.057945Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.10487","last_updated":"2022-05-21T02:14:27Z","snapshot_observed_at":"2026-08-04T13:21:32.121470Z","submitted_at":"2022-05-21T02:14:27Z","title":"Scaling Laws and Interpretability of Learning from Repeated Data","version":1},"cited_work":{"arxiv_id":"2205.10487","doi":"10.48550/arxiv.2205.10487","metadata_source":"pith","pith_arxiv_id":"2205.10487","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling Laws and Interpretability of Learning from Repeated Data","venue":"cs.LG","work_id":"136dc572-d32a-4ba7-a0e7-5b0ae080633c","year":2022},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2205.10487","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:3c7ec0976312893d30d3787b659c693168951d0dc987fb70a725418382afeac6","observation_id":"947c227c-b47a-4c5f-9bd1-c7b27ac6ea1f","resolution":{"observed_at":"2026-07-02T21:17:24.155516Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T20:01:24.810599Z","title":"Hessel, A","venue":null,"work_id":"786355e4-928d-427d-9003-9ecdc7eb9461","year":2021},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:15c1002d74e118962c9ab0a8a1df9f6251bb3bd9d4e9c1a5de52774a7b55eec7","observation_id":"63b553bb-4aa3-404c-8ce6-4e490ff6c7fa","resolution":{"observed_at":"2026-07-05T20:01:24.811681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":25,"verified_exact":49,"verified_fuzzy":24},"total_outbound_references":299},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 299 outbound references and 1 inbound Pith citation observation for arXiv:2606.28551."}