{"as_of":"2026-08-08T12:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:91f0bac8cb06384eeb7c939f9e5ce94252765b8a84f4ff862901bcd5813d5996","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:45:57.335959Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-02T21:10:10.548489Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T21:17:24.049592Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"cited_work":{"arxiv_id":"2506.04598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04598","snapshot_observed_at":"2026-07-02T21:17:24.049592Z","title":"Scaling laws for robust comparison of open foun- dation language-vision models and datasets","venue":null,"work_id":"7749353a-3fc8-4084-a4fb-311e61cca394","year":2025},"citing_paper":{"arxiv_id":"2604.14629","last_updated":"2026-04-16T05:13:57Z","snapshot_observed_at":"2026-07-06T23:02:22.790426Z","submitted_at":"2026-04-16T05:13:57Z","title":"Switch-KD: Visual-Switch Knowledge Distillation for Vision-Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-10T11:23:46.371799Z"},"links":{"cited_paper":"/paper/2506.04598","citing_paper":"/paper/2604.14629"},"observation_digest":"sha256:e086dfb102e9225e136e637af7b39f8ca720ce33551d418cb4ee1ff2a9e2c63f","observation_id":"de8930b6-1dca-41ba-bb06-23dae956c33a","resolution":{"observed_at":"2026-05-10T11:25:18.542696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"cited_work":{"arxiv_id":"2506.04598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04598","snapshot_observed_at":"2026-07-02T21:17:24.049592Z","title":"Scaling laws for robust comparison of open foun- dation language-vision models and datasets","venue":null,"work_id":"7749353a-3fc8-4084-a4fb-311e61cca394","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":1},"reference_index":222,"source":"pdf_text","source_observed_at":"2026-06-30T01:16:16.834861Z"},"links":{"cited_paper":"/paper/2506.04598","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:380dd938c72a739d6c863ecfd58dae25805333c7e83c21e81ac174bfa1d8dadc","observation_id":"541b989f-15f9-4436-abaf-d65ccac06b2e","resolution":{"observed_at":"2026-07-01T15:45:47.673551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"cited_work":{"arxiv_id":"2506.04598","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04598","snapshot_observed_at":"2026-07-02T21:17:24.049592Z","title":"Scaling laws for robust comparison of open foun- dation language-vision models and datasets","venue":null,"work_id":"7749353a-3fc8-4084-a4fb-311e61cca394","year":2025},"citing_paper":{"arxiv_id":"2606.28551","last_updated":"2026-06-30T20:49:34Z","snapshot_observed_at":"2026-08-02T23:02:11.703134Z","submitted_at":"2026-06-26T19:11:29Z","title":"DataComp-VLM: Improved Open Datasets for Vision-Language Models","version":2},"reference_index":222,"source":"pdf_text","source_observed_at":"2026-07-02T21:10:10.548489Z"},"links":{"cited_paper":"/paper/2506.04598","citing_paper":"/paper/2606.28551"},"observation_digest":"sha256:069b393ec8f202310aac287ce74cdb0998714e9b5de33c7625a8a70816fc460e","observation_id":"12abe144-1341-473c-a12a-8c4c8fea0a3d","resolution":{"observed_at":"2026-07-02T21:17:24.051026Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04598/citation-record","integrity":"/paper/2506.04598/integrity","json":"/paper/2506.04598/citation-record.json","paper":"/paper/2506.04598"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T10:45:57.091309Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.091309Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:664225a056741bc3da194a932eb27f663c22c58549e939bb648e90c3bd762b4a","observation_id":"1ca5c1e6-840d-40e1-b52c-126bfd34de4d","resolution":{"observed_at":"2026-08-07T10:45:57.091309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T10:45:57.097453Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.097453Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:a80cabfa8dfe8e385b9bc32b4fb96dcbefc998d7c158837fb050ea118adbb359","observation_id":"acef53e8-30cd-401d-94f3-bc4fcd46c31f","resolution":{"observed_at":"2026-08-07T10:45:57.097453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:58.135973Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":"6d231e63-492b-4425-baab-db7f4d7198b4","year":2020},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.102650Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:46b7d1a6f87709ccc5ec72266fd6f01f96e4ab9c4d78e4fd71046e6f210b9fdd","observation_id":"44834df0-fa3f-46a6-9e79-9bdd727e1aa8","resolution":{"observed_at":"2026-08-07T10:45:58.140930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.108231Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.108231Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:fa4067d7ef138b6855bf48604649d98835cd9b0d74f90eaf5fc2ceb076d5fc9f","observation_id":"93bbbcde-60cd-480a-b574-a19636563501","resolution":{"observed_at":"2026-08-07T10:45:57.108231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01017","last_updated":"2025-04-01T17:59:15Z","snapshot_observed_at":"2026-08-07T16:16:46.344767Z","submitted_at":"2025-04-01T17:59:15Z","title":"Scaling Language-Free Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01017","snapshot_observed_at":"2026-08-07T10:45:57.113386Z","title":"Scaling language-free visual representa- tion learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.113386Z"},"links":{"cited_paper":"/paper/2504.01017","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:282d88f2679176808b5e863033f43133fd30b5840eb3947f60e26868f18d99ff","observation_id":"d0e7881d-5fcd-4737-b05d-b6f62186d298","resolution":{"observed_at":"2026-08-07T10:45:57.113386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.118721Z","title":"Clap learning audio concepts from natural language supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.118721Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:7a4e97b25fcfb6c581066cfb637af3ba23be8411f42cb5f4ecd3e8eca0075824","observation_id":"3f04def2-5605-41f7-b35e-5945e3d1e3c6","resolution":{"observed_at":"2026-08-07T10:45:57.118721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:58.099725Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"76f4f3c7-43ce-4bc5-a346-743e2be352dc","year":2021},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.123879Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:2ec00d3c0e1dc120f40f05df5648e69f6467450d232d717cdeadcdaf4e1c6744","observation_id":"5d057258-a155-4ed5-b223-ee0eaf30e56d","resolution":{"observed_at":"2026-08-07T10:45:58.104762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T10:45:57.128550Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.128550Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:dff054b4a936718b229e3eeb68411f4f3edf50ef5755c32151e160d0eb0f6114","observation_id":"2ce64a3f-8e20-42ec-92c7-f8d3f1c86a16","resolution":{"observed_at":"2026-08-07T10:45:57.128550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:58.082604Z","title":"An empirical analysis of compute-optimal large language model training","venue":null,"work_id":"69367c90-e787-403c-9d3d-0c51aca8bd28","year":2022},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.133636Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:7fa2c2feb4ce6810aabd2972f75d90c6942ea0fa207cc242d0bb98200f9b1f35","observation_id":"74f23fb8-75bc-409f-8765-228a7f5c653d","resolution":{"observed_at":"2026-08-07T10:45:58.088399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:58.067309Z","title":"Reproducible scaling laws for contrastive language-image learning","venue":null,"work_id":"bc914e8f-007d-4841-8f6e-9e3b0c6f3790","year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.138133Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:aad308f0e28f2588f700f36034b1ddcbdfb829c487e089097062b1f2baa3fec0","observation_id":"9ba7c892-b33e-4373-ba23-7edaca9fd5db","resolution":{"observed_at":"2026-08-07T10:45:58.071917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:58.051883Z","title":"(mis)fitting scaling laws: A survey of scaling law fitting techniques in deep learning","venue":null,"work_id":"baacf0a3-a1a7-49b7-9d3f-e72008b16597","year":2025},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.142721Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:86cfbe7ba835f9c0b2363d5f4797ca773f23b5a2f966154c8929bc659282002f","observation_id":"f28d148b-66c4-4d1b-bc04-de9f2f290374","resolution":{"observed_at":"2026-08-07T10:45:58.056934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.147875Z","title":"Visual instruction tuning.Advances in neural information processing systems , 36:34892–34916, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.147875Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:3e59087f1379f5f559d2d44039282e654a1d999ec89a92e9fdc04384254f67a9","observation_id":"34c66f8c-70cf-4a75-ac21-256d108f93eb","resolution":{"observed_at":"2026-08-07T10:45:57.147875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.152587Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.152587Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:e6116f56fff453401460bb4ffd8e06449a100f3d9c2a597d8dd97c9d93b87bca","observation_id":"7baa0607-d258-4142-a008-83807da76d76","resolution":{"observed_at":"2026-08-07T10:45:57.152587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-07T10:45:57.157201Z","title":"Siglip 2: Multilingual vision-language encoders with improved semantic understanding, localization, and dense features","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.157201Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:0ca8fa23114f995d9ea4fa935cce86764dfbefc679f6bdff2abdc9cf4be12cad","observation_id":"cd523d8d-47b7-44f3-b164-60810c9f9d45","resolution":{"observed_at":"2026-08-07T10:45:57.157201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T10:45:57.162181Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.162181Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:a354f07a6b5cfc5b8ae6828fa74e46c2c051292df5cf406fc8e4ea6619179628","observation_id":"2b6c118d-8856-4090-977d-15ee53ab484d","resolution":{"observed_at":"2026-08-07T10:45:57.162181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-07-06T13:06:27.153765Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01917","snapshot_observed_at":"2026-08-07T10:45:57.166837Z","title":"Coca: Contrastive captioners are image-text foundation models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.166837Z"},"links":{"cited_paper":"/paper/2205.01917","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:8aad944865baeadd5077cc81952ebce816b6bd1bd2912a359a632a8256c7a723","observation_id":"637bdb7c-8ed5-4cca-9b5b-8a56cf18ab97","resolution":{"observed_at":"2026-08-07T10:45:57.166837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:58.003530Z","title":"Dai, Zhifeng Chen, Claire Cui, and Anelia Angelova","venue":null,"work_id":"ae65a5fb-1a1e-4755-a1b1-be6f41141681","year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.171702Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:86c939552c960f0ebe2502c2f54703d9b5d06857ab7aca234bb10a3a2dd08da2","observation_id":"a1de7b6c-b141-4c36-8c8f-6a4876133f14","resolution":{"observed_at":"2026-08-07T10:45:58.009300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.176558Z","title":"Sigmoid loss for language image pre-training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.176558Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:54d6c6fd4b039eaaa73949dae72cb3004e64c912a2fd22948543128557341f3e","observation_id":"bc8619a5-14eb-40f5-8f01-388d6c315622","resolution":{"observed_at":"2026-08-07T10:45:57.176558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.967769Z","title":"Datacomp: In search of the next generation of multimodal datasets","venue":null,"work_id":"808fc022-b3cd-444a-abf4-00cfc4140dc3","year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.180956Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:8f1c12699e458c774f9f3a719fe662efda1546c5bbe0841bfa2008e598e4a41b","observation_id":"bcc2ddf1-82ef-4148-a072-a3176b5e0937","resolution":{"observed_at":"2026-08-07T10:45:57.979841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.951521Z","title":"Data filtering networks","venue":null,"work_id":"f5325501-f9fb-4121-8ddc-be27727df88b","year":2024},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.185690Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:223d4715fc0c78a72f03a273a88a17ba8a151b63657a106fb24de7036328f718","observation_id":"02ee07dd-7e94-477a-af97-e76ba7826336","resolution":{"observed_at":"2026-08-07T10:45:57.956040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.936032Z","title":"Releasing re-laion 5b: transparent iteration on laion-5b with additional safety fixes","venue":null,"work_id":"a8e6e4a9-385c-445d-858a-9eac97da914e","year":2024},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.190130Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:40b450e653b4f044526eb08f143b5fad21f684a0884de700b163c60e079f4c53","observation_id":"90134bb7-2314-4c08-a3a4-2c39816cae23","resolution":{"observed_at":"2026-08-07T10:45:57.941225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.920648Z","title":"Ilharco, M","venue":null,"work_id":"a2400f27-4fd9-4079-a905-86972fb2c1de","year":2021},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.194816Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:71280c0bb41529047c70b06a7cf9470fd645e468416b5772c726957e54c82279","observation_id":"39de68dd-f663-42ad-86f2-c1c40c542384","resolution":{"observed_at":"2026-08-07T10:45:57.925577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-07T10:45:57.199283Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.199283Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:26aeed7447533da542a57f8f517821cec15b7ac1f428b60705ae05e9826146fb","observation_id":"93a1d00b-a6d2-48a6-bb85-95e4e2219f42","resolution":{"observed_at":"2026-08-07T10:45:57.199283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T10:45:57.204176Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.204176Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:5020617ad72414607bd3f667b578fcf565deb235b9a5f8874102a19a7b7d47ec","observation_id":"286f55c2-62df-45a9-b027-9c66a8a90d0a","resolution":{"observed_at":"2026-08-07T10:45:57.204176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.905066Z","title":"How do we know how smart ai systems are? Science, 381(6654):eadj5957, 2023","venue":null,"work_id":"fe68a853-4e1f-4568-ab2d-f60b328faa30","year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.208968Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:f14a9027d970f7f37e4b1a81af41ca6cf72679a4e60b5756fbb7861abee8b28d","observation_id":"9cdb8025-f7cc-4dc0-9af1-fb372e83e20d","resolution":{"observed_at":"2026-08-07T10:45:57.910105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.888968Z","title":null,"venue":null,"work_id":"a5a6ca70-a2fb-449c-8016-5a8167d8a063","year":2009},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.213869Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:0d16950f60e9223391a6d811cc87be20ba0c917013f4f1a5b7e1d3c5acad26ac","observation_id":"4e30626a-2374-407a-b168-c3d94509d8c0","resolution":{"observed_at":"2026-08-07T10:45:57.893598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.219349Z","title":"Do imagenet classifiers generalize to imagenet? In International conference on machine learning , pages 5389–5400","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.219349Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:376dc7abc6eea737d17118f33f61710b60b0d07f1d5a27518ec8347f12ab8895","observation_id":"4c41eb59-9ba9-4468-b18e-8b4c3854ff1e","resolution":{"observed_at":"2026-08-07T10:45:57.219349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.16241","last_updated":"2021-07-24T04:28:58Z","snapshot_observed_at":"2026-07-06T09:33:44.070039Z","submitted_at":"2020-06-29T17:59:10Z","title":"The Many Faces of Robustness: A Critical Analysis of Out-of-Distribution Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.16241","snapshot_observed_at":"2026-08-07T10:45:57.224287Z","title":"The many faces of robustness: A critical analysis of out-of-distribution generalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.224287Z"},"links":{"cited_paper":"/paper/2006.16241","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:68915e2df48c79286cfc71d6acf7bae2c0b047d1144b942a844d7e4a177da9f6","observation_id":"14a83510-e1a2-46dd-a8b6-99f611a7bcc9","resolution":{"observed_at":"2026-08-07T10:45:57.224287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.07174","last_updated":"2021-03-04T21:56:19Z","snapshot_observed_at":"2026-07-06T08:08:08.790847Z","submitted_at":"2019-07-16T17:56:30Z","title":"Natural Adversarial Examples","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.07174","snapshot_observed_at":"2026-08-07T10:45:57.229394Z","title":"Natural adversarial examples","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.229394Z"},"links":{"cited_paper":"/paper/1907.07174","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:811f3030e6d7fe6922ac92b66daff89ad2396212f83923cf1b1d3dfb5f2d84bb","observation_id":"db1515a3-2ff0-48da-bc95-a2f76eb6b5bd","resolution":{"observed_at":"2026-08-07T10:45:57.229394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13549","last_updated":"2019-11-05T03:56:06Z","snapshot_observed_at":"2026-08-06T04:01:10.195647Z","submitted_at":"2019-05-29T00:27:54Z","title":"Learning Robust Global Representations by Penalizing Local Predictive Power","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13549","snapshot_observed_at":"2026-08-07T10:45:57.234629Z","title":"Learning robust global represen- tations by penalizing local predictive power","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.234629Z"},"links":{"cited_paper":"/paper/1905.13549","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:8112c360d45a52adbe6eb7375b74e1cce875da1635b0eab97ec6d247e579c05f","observation_id":"a29d9b32-b042-40c7-9fe7-aeaccd0e0cee","resolution":{"observed_at":"2026-08-07T10:45:57.234629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.861256Z","title":"Objectnet: A large-scale bias-controlled dataset for pushing the limits of object recognition models","venue":null,"work_id":"c977b81c-e20e-4652-ab00-d6418ee9d3cc","year":2019},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.239590Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:07e46d1c5f8764be9b4de9c893077525b65a849dac146e0ac0c6a672b64696fe","observation_id":"25a887c2-9b9b-4f59-9a17-50ab430585c3","resolution":{"observed_at":"2026-08-07T10:45:57.866088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.845899Z","title":"Clip benchmark","venue":null,"work_id":"be1b9955-de81-43a5-859a-9a3e90b47828","year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.244247Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:d7bdeab557c58cf242d6cc5958bec283091b82aa4d29161b8157e8341c7c0309","observation_id":"7fd08321-801b-4c57-9ca4-2b92ee450a94","resolution":{"observed_at":"2026-08-07T10:45:57.850736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.248707Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.248707Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:470994e3b3dd3fb710eae5ba4b7a07925525641af6771dbd1bb3281450457615","observation_id":"1d384a28-0b0e-4522-836b-d9d094394d16","resolution":{"observed_at":"2026-08-07T10:45:57.248707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.819564Z","title":"Scene Parsing through ADE20K Dataset","venue":null,"work_id":"6f809930-4b89-410b-aa08-27a5c59072b2","year":2017},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.253256Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:703a871f01720d63a1dfce84feb8d8383f7ca0c57f3e188012d789bf4aaae69e","observation_id":"8094ea76-a661-4168-87d4-3342eafc995c","resolution":{"observed_at":"2026-08-07T10:45:57.824555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.803342Z","title":null,"venue":null,"work_id":"aa8ab1b6-4247-4ede-8010-6dafc09c54a5","year":2024},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.257778Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:8aad982c42e6c1d71bdd9d543e25543050772d04fdab7fda7d1677390cd6c821","observation_id":"d47fe5ec-d400-498c-8cc9-2d1da58b8dad","resolution":{"observed_at":"2026-08-07T10:45:57.808714Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.782239Z","title":"Your ViT is Secretly an Image Segmen- tation Model","venue":null,"work_id":"f9722426-23b0-448d-ba73-440e50e1ab33","year":2025},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.262599Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:6c55d8b03fb0ba2276c308529dd8903eb460e037350434be93077087ef666cfb","observation_id":"ce68d3f6-4f71-4e1d-8d08-9436c2462f63","resolution":{"observed_at":"2026-08-07T10:45:57.787578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.767152Z","title":"Scaling vision transform- ers","venue":null,"work_id":"9dc38acd-fa50-410f-9367-1ab1e24ebcb3","year":2022},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.267525Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:d9f9a8245013cdf450ed14aab1fadb0636890f1dd2924e245eb62d1033e5b1e9","observation_id":"94936934-adf6-4909-a1c0-49c6c8316a57","resolution":{"observed_at":"2026-08-07T10:45:57.771821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.14701","last_updated":"2020-11-06T04:16:36Z","snapshot_observed_at":"2026-07-06T10:09:17.078776Z","submitted_at":"2020-10-28T02:17:24Z","title":"Scaling Laws for Autoregressive Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.14701","snapshot_observed_at":"2026-08-07T10:45:57.272521Z","title":"Scaling laws for autoregressive generative modeling","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.272521Z"},"links":{"cited_paper":"/paper/2010.14701","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:309a636b51a5df6442fe4b209fc4b41f9eda8273e07b361b1fd2eee69af8be55","observation_id":"d5199c9c-6c70-4c14-a6f6-17a392ab4206","resolution":{"observed_at":"2026-08-07T10:45:57.272521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T10:45:57.277665Z","title":"Training compute-optimal large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.277665Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:f5a7ecb7acce263b394415c4db3f73e2ec0decc4e4a21459c7c63d82787cce69","observation_id":"046e0180-4626-4848-8efd-50d5115a8ebb","resolution":{"observed_at":"2026-08-07T10:45:57.277665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.750419Z","title":"The skyline operator","venue":null,"work_id":"c10710dd-12d0-4659-a138-3e6543f31225","year":2001},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.282548Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:ba3bf46af74c2e6dbea1e7e877e275f2cdd21e23ed06d4777a83be1a2cae8fb4","observation_id":"ed4b4c7b-c2c2-480b-a9f8-f3de656ccbaf","resolution":{"observed_at":"2026-08-07T10:45:57.755809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.733272Z","title":"Scaling data-constrained language models","venue":null,"work_id":"59731903-04d2-4948-9bf4-beee1eec607d","year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.292102Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:45d76f86635f62f98ff96127b7724ad1238829e086913ee10a9973984d7e7f1b","observation_id":"a99369db-6c2e-4c3b-8bd3-6ded42d0875c","resolution":{"observed_at":"2026-08-07T10:45:57.738323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.717508Z","title":"LAION-5B: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"49c2db6d-9044-495a-97cf-1d288b94c5fe","year":2022},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.297088Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:1a308f05e9bd645c757b87516004d776b3a59987c12807e722e7579c8f1ec73a","observation_id":"73ad35d4-0f16-4ed5-983e-78e37d1268ed","resolution":{"observed_at":"2026-08-07T10:45:57.722430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.701950Z","title":"Image captioners are scalable vision learners too","venue":null,"work_id":"1c08a74f-7d9b-4f0a-a06d-f581231a8ca4","year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.302318Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:2a223abb3ef9af9738cd092490afac929bc76282ee57d459df91bd655bc1508d","observation_id":"78671c41-9a33-4e43-a4b4-ef6a578adc9c","resolution":{"observed_at":"2026-08-07T10:45:57.706928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.686838Z","title":"Resolving discrepancies in compute-optimal scaling of language models","venue":null,"work_id":"025aed8c-ab59-4557-b954-b9b69251ee29","year":2024},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.307432Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:d84fca9f4582e4248d3318d1b618f287a27c3a9eaf244cb7c9eafb93a4b86e79","observation_id":"0e528714-4234-467f-ad89-41fe2cca0446","resolution":{"observed_at":"2026-08-07T10:45:57.691597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16671","last_updated":"2025-11-23T00:34:43Z","snapshot_observed_at":"2026-08-02T18:24:11.208164Z","submitted_at":"2023-09-28T17:59:56Z","title":"Demystifying CLIP Data","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16671","snapshot_observed_at":"2026-08-07T10:45:57.312187Z","title":"Demystifying clip data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.312187Z"},"links":{"cited_paper":"/paper/2309.16671","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:81e22fe49602508cc01015dfb9145d116ffcf06ce0649fde9024d8f21e461ab7","observation_id":"bd523a73-f559-4764-b8a4-5718bd18eab8","resolution":{"observed_at":"2026-08-07T10:45:57.312187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15389","last_updated":"2023-03-27T17:02:21Z","snapshot_observed_at":"2026-07-06T15:08:34.018146Z","submitted_at":"2023-03-27T17:02:21Z","title":"EVA-CLIP: Improved Training Techniques for CLIP at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15389","snapshot_observed_at":"2026-08-07T10:45:57.317081Z","title":"Eva-clip: Improved training techniques for clip at scale","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.317081Z"},"links":{"cited_paper":"/paper/2303.15389","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:3b05a76113cc419b6fad0cdd3cf97743199ed4801d613fb01874bb6d75dcd90d","observation_id":"d69a5fdb-fed8-4b23-8590-b03f75812f51","resolution":{"observed_at":"2026-08-07T10:45:57.317081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15485","last_updated":"2025-04-07T21:50:58Z","snapshot_observed_at":"2026-08-07T16:51:00.631813Z","submitted_at":"2025-03-19T17:58:57Z","title":"TULIP: Towards Unified Language-Image Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15485","snapshot_observed_at":"2026-08-07T10:45:57.321888Z","title":"Tulip: Towards unified language-image pretraining","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.321888Z"},"links":{"cited_paper":"/paper/2503.15485","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:898e8fe2883bb97892c6a8228705e2736a2265eebeab4b102ef8461a22c35d28","observation_id":"1ca84f57-c161-401b-939f-f32b0ecf4a29","resolution":{"observed_at":"2026-08-07T10:45:57.321888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04601","last_updated":"2025-05-07T17:48:35Z","snapshot_observed_at":"2026-08-07T15:49:05.464106Z","submitted_at":"2025-05-07T17:48:35Z","title":"OpenVision: A Fully-Open, Cost-Effective Family of Advanced Vision Encoders for Multimodal Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04601","snapshot_observed_at":"2026-08-07T10:45:57.326630Z","title":"Openvision: A fully-open, cost-effective family of advanced vision encoders for multimodal learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.326630Z"},"links":{"cited_paper":"/paper/2505.04601","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:db1707764643cdbadd67fb59b587ec5bb3608cb9781ec71655f5311143c84f5f","observation_id":"1ccba6ff-ad5d-47f6-83c9-b306beaa141c","resolution":{"observed_at":"2026-08-07T10:45:57.326630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10551","last_updated":"2022-07-21T15:50:22Z","snapshot_observed_at":"2026-07-06T13:33:51.229850Z","submitted_at":"2022-07-21T15:50:22Z","title":"Scaling Laws vs Model Architectures: How does Inductive Bias Influence Scaling?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.10551","snapshot_observed_at":"2026-08-07T10:45:57.331326Z","title":"Scaling laws vs model architectures: How does inductive bias influence scaling? arXiv preprint arXiv:2207.10551, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.331326Z"},"links":{"cited_paper":"/paper/2207.10551","citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:2b2fc8ccfb9b94d66612b4440dc3ca3ac2c40bd7043b21e0ee759fad155ce5b1","observation_id":"75ab3d08-8b34-412b-9e88-1b4add3782ba","resolution":{"observed_at":"2026-08-07T10:45:57.331326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:45:57.668831Z","title":"Scaling laws for data filtering–data curation cannot be compute agnostic","venue":null,"work_id":"983fa5b5-77a3-448c-9bc0-5c99092be57c","year":2024},"citing_paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:45:57.335959Z"},"links":{"citing_paper":"/paper/2506.04598"},"observation_digest":"sha256:a130999d8b0d16771fd0f552869e75540ce5e2be0d0a2c8bcb34efb5eaac524a","observation_id":"984f70ed-4379-4900-9f0b-0a89e3be1cc5","resolution":{"observed_at":"2026-08-07T10:45:57.675781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.04598","last_updated":"2025-06-05T03:35:59Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T10:35:53.116133Z","submitted_at":"2025-06-05T03:35:59Z","title":"Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 3 inbound Pith citation observations for arXiv:2506.04598."}