{"as_of":"2026-08-08T06:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7edbd581f43841b20efcfc37e781db8a5229133c59ffc3770790ee597a32e3ba","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:44:17.754628Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01586/citation-record","integrity":"/paper/2506.01586/integrity","json":"/paper/2506.01586/citation-record.json","paper":"/paper/2506.01586"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.162388Z","title":"Unsupervised label noise modeling and loss correction","venue":null,"work_id":"7b4c032e-81f3-4a4d-9af0-02ab62d0e502","year":2019},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.591317Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:3fc3900d179f2fdc666a75ec98aee63de4f87a8b0222abb00e2478eceb9abc91","observation_id":"e8861af3-38f8-4c25-8f19-aaaef357860e","resolution":{"observed_at":"2026-08-07T11:44:18.165600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.155111Z","title":"A closer look at memorization in deep networks","venue":null,"work_id":"4d6570f7-db65-4d15-84fd-593414bae94f","year":2017},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.595183Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:2605bcbdefc651044a48406f09066cf6ec23af1c408dd177bef9bb185f015463","observation_id":"efdd2078-e862-4310-a29b-2c6a3ce63018","resolution":{"observed_at":"2026-08-07T11:44:18.157870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.598573Z","title":"High-performance large-scale image recognition without normalization","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.598573Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:b63d29741944b4463ac49717c7fd0efafb0b411a3fd0f0e87d91490b03106116","observation_id":"7f8ab341-63db-4ae0-b198-ab39fcf739fc","resolution":{"observed_at":"2026-08-07T11:44:17.598573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.144618Z","title":"Dataset distillation by matching training trajectories","venue":null,"work_id":"8d2cef17-fec5-4360-aaff-7811cd30e40f","year":2022},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.601834Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:724ebf25266740e48bbcc4d4d7dbd34c565fe622b9dc44fbb27bac9b29d8f181","observation_id":"854c2aee-f540-4ebb-8ce5-2e11a65c7e81","resolution":{"observed_at":"2026-08-07T11:44:18.147325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.604742Z","title":"Scaling up dataset distillation to imagenet- 1k with constant memory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.604742Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:277b64715ff000abc5e024949db1df49d31d4a9cf8008b25d589f4835cdfccb1","observation_id":"f07af8d5-6464-446c-ad7c-4a45ebac25f8","resolution":{"observed_at":"2026-08-07T11:44:17.604742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.133547Z","title":"Noisy correspondence learning with self-reinforcing errors mitigation","venue":null,"work_id":"968dc066-4062-4630-9185-1bb27fbf4107","year":2024},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.607844Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:da089840c98015a2aefb3b7b41e0e440be1daa62ee1768974ea00eca1a2f1e9f","observation_id":"b87bd022-4fd0-405c-b2c2-9e6da6d39564","resolution":{"observed_at":"2026-08-07T11:44:18.136589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.126022Z","title":"Disentangled noisy correspondence learning.IEEE Transactions on Image Processing, 2025","venue":null,"work_id":"f90202e0-8b6c-481f-9842-3d2b9c8960c5","year":2025},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.611673Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:19a64e9279b5aedace53c794f56d13c0ee8e4a09968914315c8c2651b0095d46","observation_id":"0bd327be-de2a-45cd-9146-8080f28289e5","resolution":{"observed_at":"2026-08-07T11:44:18.128806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.614319Z","title":"Imagenet: A large- scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.614319Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:bf5cc515f50ef47561b761c5b9e95bb9822e8ffd23063e619539bc7ce0312654","observation_id":"148b4a67-7ba3-4c88-b5c2-9cc8b33efb25","resolution":{"observed_at":"2026-08-07T11:44:17.614319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T11:44:17.617842Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.617842Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:c66f7a5100342bed12eecdbe508d69094796621189c36f3a5d1474eab4574b43","observation_id":"146cf841-c440-457c-9c11-5dd6f40bf66f","resolution":{"observed_at":"2026-08-07T11:44:17.617842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.114434Z","title":"Similarity reasoning and filtration for image-text matching","venue":null,"work_id":"37717944-d2f4-4288-8b53-3382310e5099","year":2021},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.620531Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:950f331faa7082b1566ea6cb19364453813745edf6ee14095c7174aa9e7f3570","observation_id":"99a4ebda-862c-4ca9-8610-eefde61ba500","resolution":{"observed_at":"2026-08-07T11:44:18.117914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T11:44:17.623896Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.arXiv preprint arXiv:2010.11929, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.623896Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:9b3410ec13cf7eeda90e232ea57ea3c11935182ec77c34fe67b3580cabdd92cb","observation_id":"73963fd7-8ffd-4acc-b711-86f66c01f52c","resolution":{"observed_at":"2026-08-07T11:44:17.623896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.627268Z","title":"Robust loss functions under label noise for deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.627268Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:90fbe2aaccecf73dc7d6d5e44e7add51f2d7244289da5f844966bfdbd19827e6","observation_id":"ffd70ee0-e1fc-4c4c-b309-4b82a44d1585","resolution":{"observed_at":"2026-08-07T11:44:17.627268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.102181Z","title":"To- wards lossless dataset distillation via difficulty-aligned trajectory matching","venue":null,"work_id":"e273b4e9-20cc-4f71-94e8-114635733650","year":2024},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.629829Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:66258bc5cfd1fa431f4b5413764f9778e9642fc778b97fd45dbf772a23b4cab0","observation_id":"00b6ced3-5327-409a-9f16-f3ea46173565","resolution":{"observed_at":"2026-08-07T11:44:18.105134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.093935Z","title":"Noisy correspondence learning with meta similarity correction","venue":null,"work_id":"5e41a39e-c6c7-444f-bf2a-3539480a2c10","year":2023},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.632787Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:d02e8ff13d19e568b9f99f31a246f2a06e74d6ede58509c2d0ae23798f86f7a3","observation_id":"b60c3f33-9746-4cd1-9794-fa014abba173","resolution":{"observed_at":"2026-08-07T11:44:18.097434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.636081Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.636081Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:320adfe0e366a0a74e4c7b19ec390381770c556364c1018154d964070f711fb0","observation_id":"c1ea639d-6560-42cc-89d6-b7bc6e0e3e29","resolution":{"observed_at":"2026-08-07T11:44:17.636081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.081973Z","title":"Learning with noisy correspondence for cross-modal matching.Advances in Neural Information Processing Systems, 34:29406–29419, 2021","venue":null,"work_id":"7b5b173b-8863-410e-aa0d-0b3c9a742949","year":2021},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.639173Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:a6628a35dee7b042aa19f786d0ea7c7fcd03a1eb9b6d3b4d9dbfa8467dde6aa6","observation_id":"6380d337-a121-4206-81aa-73690bef5e05","resolution":{"observed_at":"2026-08-07T11:44:18.084662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T11:44:17.642536Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.642536Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:c33f84d38bc3aa161e77e9ded1011268d87e09098e984f05d5350bf03c8a120b","observation_id":"e94a469b-3ef5-403d-8b76-3fd81866bb1e","resolution":{"observed_at":"2026-08-07T11:44:17.642536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.074367Z","title":"Generating action-conditioned prompts for open-vocabulary video action recognition","venue":null,"work_id":"8cf08cfc-430d-4ac8-b8c9-70f908c8cb5f","year":2024},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.645231Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:52a4e27603ae9d8d209d65cd9154e62bc387734721278e5cae55498d10d57db7","observation_id":"356208d9-5248-429f-b550-9ac5fed69c36","resolution":{"observed_at":"2026-08-07T11:44:18.077429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18603","last_updated":"2024-10-24T09:58:40Z","snapshot_observed_at":"2026-07-06T19:39:01.657517Z","submitted_at":"2024-10-24T09:58:40Z","title":"AgentStore: Scalable Integration of Heterogeneous Agents As Specialized Generalist Computer Assistant","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18603","snapshot_observed_at":"2026-08-07T11:44:17.648911Z","title":"Agentstore: Scalable integration of heterogeneous agents as specialized generalist computer assistant.arXiv preprint arXiv:2410.18603, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.648911Z"},"links":{"cited_paper":"/paper/2410.18603","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:0b8dd1c71894e895565c6a8ea8620ceae4b46ac49db37b4d5103ead0bb3bfbab","observation_id":"cb979748-d402-44de-a642-7f6d58eacc77","resolution":{"observed_at":"2026-08-07T11:44:17.648911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17176","last_updated":"2024-11-26T07:31:12Z","snapshot_observed_at":"2026-07-06T19:57:06.097199Z","submitted_at":"2024-11-26T07:31:12Z","title":"ChatGen: Automatic Text-to-Image Generation From FreeStyle Chatting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.17176","snapshot_observed_at":"2026-08-07T11:44:17.652221Z","title":"Chatgen: Automatic text-to-image generation from freestyle chatting.arXiv preprint arXiv:2411.17176, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.652221Z"},"links":{"cited_paper":"/paper/2411.17176","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:5b8c8d120eceb2e1613d539bd0b7196be89c85d27ee5c82747d2e7f6aab58d10","observation_id":"e94d00c8-0c40-4a7a-8949-ce13bb988b5f","resolution":{"observed_at":"2026-08-07T11:44:17.652221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.066041Z","title":"Stacked cross attention for image-text matching","venue":null,"work_id":"9d198959-1558-41e2-b049-fd5f615ef53d","year":2018},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.655345Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:3849e356b7478e7875592d2ad4f752fb55cd5254b4d99c823fdac8cd0ce51d41","observation_id":"237c2e77-f764-4350-a308-218f9e4474ed","resolution":{"observed_at":"2026-08-07T11:44:18.069553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.658496Z","title":"Factorized contrastive learning: Going beyond multi-view redundancy.Advances in Neural Information Processing Systems, 36:32971–32998, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.658496Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:e7e8ac05aadfeff53634424a4984ec8dbbc61b6c81f12ad8e5000da281e13bfc","observation_id":"9cdf1e19-db08-4b94-a30f-c3b055432a5b","resolution":{"observed_at":"2026-08-07T11:44:17.658496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02002","last_updated":"2018-02-07T18:44:44Z","snapshot_observed_at":"2026-07-06T05:54:18.908943Z","submitted_at":"2017-08-07T06:32:42Z","title":"Focal Loss for Dense Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02002","snapshot_observed_at":"2026-08-07T11:44:17.661485Z","title":"Focal loss for dense object detection.arXiv preprint arXiv:1708.02002, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.661485Z"},"links":{"cited_paper":"/paper/1708.02002","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:119e803cd014ff43cbc960ae750a4eb12c3066ec4d3fb6386a860fa1fb40f90a","observation_id":"25d1c708-a111-4614-afc0-7bdfbeac7eeb","resolution":{"observed_at":"2026-08-07T11:44:17.661485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.664971Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.664971Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:c5dfbb043281ec67d915cec5d1d3dbbd1f10e6f4d2f12676b87ecf475b2865ca","observation_id":"939c7d9f-00ca-4975-a2d1-de1224246c22","resolution":{"observed_at":"2026-08-07T11:44:17.664971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.667770Z","title":"Energy-based out-of-distribution detection.Advances in neural information processing systems, 33:21464–21475, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.667770Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:163f27db412b47fe7728a53bc7f7d301175c4ba46bccfdbc63f416f040b0cd89","observation_id":"375f0d62-a06b-461e-a33a-751344175ddf","resolution":{"observed_at":"2026-08-07T11:44:17.667770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.046060Z","title":"Dataset distillation with convexi- fied implicit gradients","venue":null,"work_id":"aabf2986-a447-48ff-bb52-c0fdf239a781","year":2023},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.671022Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:afd88d5f09ccc5afe4c1cd9dd58b551a30bc6c070966d12361dc536031593a96","observation_id":"7685f918-5206-4b40-96cd-ed3c9a50a328","resolution":{"observed_at":"2026-08-07T11:44:18.049680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.674164Z","title":"The expectation-maximization algorithm.IEEE Signal processing magazine, 13(6):47–60, 1996","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.674164Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:0110efa2c6fd5a4df3e9f2f25a0eed396d5ecaa894bcae235df09440bb3f5686","observation_id":"8ca428d1-6a3d-44d2-9994-3a9cc63990d2","resolution":{"observed_at":"2026-08-07T11:44:17.674164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.034640Z","title":"Dataset meta-learning from kernel ridge-regression","venue":null,"work_id":"bad90378-e21c-4227-9431-249874330559","year":2020},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.677676Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:823641ee556c9d14f5ee52601d1fe692450542ca71d8f2dcd60b1bd3d1044eed","observation_id":"d38af957-41f6-41c0-a47d-c3b7c59aa6d2","resolution":{"observed_at":"2026-08-07T11:44:18.037629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.681017Z","title":"Autogps: Automated geometry problem solving via multimodal formalization and deductive reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.681017Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:6ef35ee2f5feafdb992570440db50cb042c0745ba94c55b6278030fcb781c1e1","observation_id":"e6c10140-769c-4e7e-81db-c340c2e91b38","resolution":{"observed_at":"2026-08-07T11:44:17.681017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.684439Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.684439Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:6551b5e96b8dd106f80108b6ff022badb60351d9a85e63186a0cb294673c8235","observation_id":"1a37ad62-6a50-4cb4-9ebf-cb93c254c207","resolution":{"observed_at":"2026-08-07T11:44:17.684439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.687851Z","title":"Design- ing network design spaces","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.687851Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:b9e8614c59c6948ebc9df4b53df25aceb89ab191f0fb994c8ebd86948eaf0cce","observation_id":"3f3301c7-802e-4621-8ff9-2c7d881f976d","resolution":{"observed_at":"2026-08-07T11:44:17.687851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T11:44:17.690958Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter.arXiv preprint arXiv:1910.01108, 2019","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.690958Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:985cdc7310c1fa4bb36091eb48098af0bb70d2fad39e947992ab77e2c889cf12","observation_id":"8fa11317-b950-4750-b38c-cc5ea2593d65","resolution":{"observed_at":"2026-08-07T11:44:17.690958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.694200Z","title":"Grad-cam: Visual explanations from deep networks via gradient-based localization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.694200Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:442b0cc494ef4c9693ce4f15cb037b6becc9d9620fc690f2f48f466a572140e2","observation_id":"0b83ff28-56d0-4595-ad73-ac782ea2d3de","resolution":{"observed_at":"2026-08-07T11:44:17.694200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.697298Z","title":"Active learning for convolutional neural networks: A core-set approach","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.697298Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:72cffac5076c1cb14e8349833ea920fe46ee47b6b11230a1d33b781793fae956","observation_id":"41c371e5-c526-4741-9f46-962f4f052643","resolution":{"observed_at":"2026-08-07T11:44:17.697298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.700698Z","title":"Conceptual captions: A cleaned, hypernymed, image alt-text dataset for automatic image captioning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.700698Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:15d49f75762317e5242f0a04d3e4f63b8971d4964645279e73812955674e7fb3","observation_id":"b2067827-0103-4213-acbd-e676f0eae0cd","resolution":{"observed_at":"2026-08-07T11:44:17.700698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T11:44:17.704007Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.704007Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:80bf4b933c8d31c315bc6fdabf4f3cb7bd9810017b6d97e40f23e6b0fc6ab820","observation_id":"09a004e0-f92a-41db-8d12-4e104d54bb13","resolution":{"observed_at":"2026-08-07T11:44:17.704007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05159","last_updated":"2019-11-15T17:08:30Z","snapshot_observed_at":"2026-08-01T06:33:25.731787Z","submitted_at":"2018-12-12T21:24:15Z","title":"An Empirical Study of Example Forgetting during Deep Neural Network Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05159","snapshot_observed_at":"2026-08-07T11:44:17.707363Z","title":"An empirical study of example forgetting during deep neural network learning.arXiv preprint arXiv:1812.05159, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.707363Z"},"links":{"cited_paper":"/paper/1812.05159","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:04d7b2329bdbf76122e768a00835dd04e162c1f2a41706ebc7a04870f1b264c3","observation_id":"fc1b7df1-950e-449b-8fb5-8b96e6c4ee84","resolution":{"observed_at":"2026-08-07T11:44:17.707363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:18.007281Z","title":"High-frequency component helps explain the generalization of convolutional neural networks","venue":null,"work_id":"6a43aa1d-5dc5-4490-8c6f-3cc814f69c37","year":2020},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.710208Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:c52e49fe30195984808cfce6287e443606390c7c26453a4ae4078e1b5bc596c2","observation_id":"0e3b9f3c-8145-4ae8-8909-143a6515b9d2","resolution":{"observed_at":"2026-08-07T11:44:18.010178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.998384Z","title":"Cafe: Learning to condense dataset by aligning features","venue":null,"work_id":"0f844ee0-60cc-4ede-ad07-569a43857d45","year":2022},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.713358Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:773db67835f313993f493d5cdb36eb013b26f39d74c1cb0da565f174a217e377","observation_id":"75781d3d-d7da-4628-90ce-3e346f96d578","resolution":{"observed_at":"2026-08-07T11:44:18.002261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07545","last_updated":"2024-08-20T14:59:55Z","snapshot_observed_at":"2026-08-02T13:00:05.823222Z","submitted_at":"2023-08-15T03:22:40Z","title":"Vision-Language Dataset Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07545","snapshot_observed_at":"2026-08-07T11:44:17.715799Z","title":"Multimodal dataset distillation for image-text retrieval.arXiv preprint arXiv:2308.07545, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.715799Z"},"links":{"cited_paper":"/paper/2308.07545","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:577e7083834ba54c051cf834ab481c7ac10c11a00a4a39bcb8004f682b76ea53","observation_id":"aeb995fd-8f1e-457d-96e3-22f7eabc67c6","resolution":{"observed_at":"2026-08-07T11:44:17.715799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23218","last_updated":"2024-10-30T17:10:19Z","snapshot_observed_at":"2026-08-05T06:30:40.974506Z","submitted_at":"2024-10-30T17:10:19Z","title":"OS-ATLAS: A Foundation Action Model for Generalist GUI Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23218","snapshot_observed_at":"2026-08-07T11:44:17.719167Z","title":"Os-atlas: A foundation action model for generalist gui agents.arXiv preprint arXiv:2410.23218, 2024","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.719167Z"},"links":{"cited_paper":"/paper/2410.23218","citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:eb2837941bb8a3fae085502294fba518746bd6e5e95f0886a71e11ebd075578a","observation_id":"624b556a-045f-4eb8-ab6f-967d60547aa4","resolution":{"observed_at":"2026-08-07T11:44:17.719167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.990170Z","title":"Regularly truncated m-estimators for learning with noisy labels.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2023","venue":null,"work_id":"0639d809-a6da-4982-aa18-dde4552d7586","year":2023},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.722081Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:1e207f1245c4c48b2780414aa08e2758e3dd7046133f420c489996f4a38accdd","observation_id":"f0075f6f-ef8a-4208-a1a5-b160590e188d","resolution":{"observed_at":"2026-08-07T11:44:17.993304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.982425Z","title":"Low-rank similarity mining for multimodal dataset distillation","venue":null,"work_id":"f77c593c-1939-447a-82ef-c182861e1087","year":2024},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.725111Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:e43dd38d72d4a21a36a4dd56e84155f9d18e92b108722062a0b4f6e4f4a43710","observation_id":"697a923b-7797-415e-9ea9-3250b58ff5bf","resolution":{"observed_at":"2026-08-07T11:44:17.985434Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.972974Z","title":"Bicro: Noisy correspondence rectification for multi-modality data via bi-directional cross-modal similarity consistency","venue":null,"work_id":"0802fa90-3666-47b7-8e9a-7221a50435a5","year":2023},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.727784Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:25d8388687b0603333f56546f72c351587ac9c160e5bf79ecae31d2b77486010","observation_id":"72f127ff-b64f-4ae9-9ea6-d5fa71e75d52","resolution":{"observed_at":"2026-08-07T11:44:17.976962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.730548Z","title":"Robust noisy correspondence learning with equivariant similarity consistency","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.730548Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:20b6914e4eb9d755d4b42fc1feeb2f6ce13da364d1aec60ec533fe44fc7589c5","observation_id":"b90443d6-955a-4163-aa62-ab460dc0388f","resolution":{"observed_at":"2026-08-07T11:44:17.730548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.959513Z","title":"Searching to exploit memorization effect in learning with noisy labels","venue":null,"work_id":"894283a6-696c-4946-9ea4-5af4fca451c7","year":2020},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.733609Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:92cd11a8dee8ec915be3920d24a0316c565156f30e1abc0d39b87c6040f9c87a","observation_id":"535f2fda-a9dd-4561-b547-edd701223930","resolution":{"observed_at":"2026-08-07T11:44:17.963044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.736950Z","title":"From image descriptions to visual denotations: New similarity metrics for semantic inference over event descriptions","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.736950Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:d7d8bed33543c152f075eb85fc3c53160a632e6fe52fa9d6fca8d651f995c466","observation_id":"54bfabab-ea71-44be-a768-6d842048d54d","resolution":{"observed_at":"2026-08-07T11:44:17.736950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.946614Z","title":"Dataset distillation: A comprehensive review","venue":null,"work_id":"d1b1525e-d113-431b-96e6-d41c836bb89a","year":2023},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.740097Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:0a69da312beb6360cd08c77950025b60a092c487dc9c73ad8a1b9c2ab5e42d03","observation_id":"ffbc2e0a-137e-4e71-96bb-e85f1faa6974","resolution":{"observed_at":"2026-08-07T11:44:17.950045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.938048Z","title":"Visualizing and understanding convolutional networks","venue":null,"work_id":"a72a1857-459d-4b68-9b9f-d46d2c32c718","year":2014},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.742741Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:46c9838e71972d59474ad5579ac3d79a7715e099d64028d347fe2ade10474b8f","observation_id":"ef2287a9-f7f7-4a71-9e98-420a2dbc2052","resolution":{"observed_at":"2026-08-07T11:44:17.941323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.746008Z","title":"Generalized cross entropy loss for training deep neural networks with noisy labels.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.746008Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:43df36ebca82a866edcc298a80d0d8d5f76a0f555c9b6661f64cb5975f4dba6b","observation_id":"4b8cd8f3-fb65-4c97-b3cb-483bf72bf782","resolution":{"observed_at":"2026-08-07T11:44:17.746008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.748861Z","title":"Dataset condensation with gradient matching","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.748861Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:15023b35ef1939f390d31c40df3ed44f9f828f7eb7cd336700d4280fe0688223","observation_id":"6ec1e89c-c0d5-4527-90f1-5afa4a9fb78a","resolution":{"observed_at":"2026-08-07T11:44:17.748861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.921432Z","title":"Mitigating noisy correspondence by geometrical structure consistency learning","venue":null,"work_id":"cfb6b640-dd5b-4f33-806b-e77479baaaa9","year":2024},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.751771Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:1032a01f75f0c47e403054ff22b15a7623a42b628f05431864332cc7562a1386","observation_id":"bfd47396-edcb-4a88-aa03-a651d55b9f15","resolution":{"observed_at":"2026-08-07T11:44:17.924828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:44:17.911960Z","title":"girl\" and “couple","venue":null,"work_id":"b378fe71-2f19-47bf-83f8-8ede3d9aba34","year":2022},"citing_paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.754628Z"},"links":{"citing_paper":"/paper/2506.01586"},"observation_digest":"sha256:9bede3fa441b964ec2ea5ca46e061c5fc954ebd2323555c1bfc52f7937f2af37","observation_id":"e769d190-4e96-4786-a79b-6e6f31f96fc0","resolution":{"observed_at":"2026-08-07T11:44:17.915653Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01586","last_updated":"2025-06-02T12:18:20Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T11:35:47.610511Z","submitted_at":"2025-06-02T12:18:20Z","title":"Multi-Modal Dataset Distillation in the Wild"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2506.01586."}