{"as_of":"2026-08-05T11:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a6cf1c86e2cdbb36ed5721b47c40000ec3e12fe4db46ca2ea1b19d6ea6aed5c4","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T19:49:29.111971Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.16859/citation-record","integrity":"/paper/2607.16859/integrity","json":"/paper/2607.16859/citation-record.json","paper":"/paper/2607.16859"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:20.292009Z","title":"Automatic differentiation in py- torch","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:20.292009Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:35e5166f19017d5d9e8a87c6cb886b854f5759f586777f4343108d287d903cdf","observation_id":"11999c20-d137-4931-b2cc-3fb8cf06bf81","resolution":{"observed_at":"2026-08-01T19:49:20.292009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:20.382342Z","title":"Learning multiple layers of features from tiny images.Technical report, 2009","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:20.382342Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:4a4b233d354c5e050ed6e4691d5ff67453477af4bf63497767fe25d4a7077776","observation_id":"aa9972a3-b9b0-41c8-93f2-811dfe54650b","resolution":{"observed_at":"2026-08-01T19:49:20.382342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00034","last_updated":"2021-12-02T21:06:20Z","snapshot_observed_at":"2026-08-02T07:28:20.038757Z","submitted_at":"2021-10-29T18:22:46Z","title":"Neural Networks as Kernel Learners: The Silent Alignment Effect","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00034","snapshot_observed_at":"2026-08-01T19:49:20.540913Z","title":"Neural networks as kernel learners: The silent alignment effect.arXiv preprint arXiv:2111.00034, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:20.540913Z"},"links":{"cited_paper":"/paper/2111.00034","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:1dd0c5d5c50a767479ea15b087158f9298b5b69183b46c56b0c8445cb8f315f1","observation_id":"64077153-a916-42d5-aa27-9b9f0b7d5ce2","resolution":{"observed_at":"2026-08-01T19:49:20.540913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:20.747882Z","title":"On second- order group influence functions for black-box predictions","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:20.747882Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:481982d6ac8d1d8a08a316358417a5a7effca9b786c6d0558726d683ef933b3d","observation_id":"40a2b0d1-e951-4926-96ab-7098dd85e707","resolution":{"observed_at":"2026-08-01T19:49:20.747882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:20.888187Z","title":"Flexible dataset distillation: Learn labels instead of images","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:20.888187Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:b8a13ac3eff9fc7d89b993775d92bc98b2467fe9a44ea63ff743e3762688cb9d","observation_id":"a10ec697-21b6-4998-bd36-d44143310fe9","resolution":{"observed_at":"2026-08-01T19:49:20.888187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:21.027406Z","title":"Smith, and Karen Si- monyan","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:21.027406Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:149501f536a5a2dbe5852387d1b232405bc3de66a5112258618b8e2db72c8cd4","observation_id":"0287b1df-05e2-496b-bcda-d4eaa4aac4cf","resolution":{"observed_at":"2026-08-01T19:49:21.027406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:21.166359Z","title":"Dataset distillation by matching training trajectories","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:21.166359Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:f3d7af64a6a2764ae983166b37afe775ef7ce33ed122a4e02e96ff66e3ec8f78","observation_id":"e20ba28f-4884-461d-8e4f-18bb710c33f5","resolution":{"observed_at":"2026-08-01T19:49:21.166359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:21.323509Z","title":"Generalizing dataset distillation via deep generative prior","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:21.323509Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:e78093ed062b84e2a9a85de1ad4af9f44a24a0adf2384338bf5560e2766fecc7","observation_id":"bf81b67d-75fe-44ee-a1e9-45980400130c","resolution":{"observed_at":"2026-08-01T19:49:21.323509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:21.530464Z","title":"Rkhs-shap: Shapley values for kernel methods.Ad- vances in neural information processing systems, 35:13050– 13063, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:21.530464Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:e43923ae988e868f95fe8256f05866731c6f6ded72fe474727af48ba400fb401","observation_id":"5b0803a8-07fc-4db6-a5aa-9bb07843b04e","resolution":{"observed_at":"2026-08-01T19:49:21.530464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:21.728964Z","title":"Aligning effective tokens with video anomaly in large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:21.728964Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:7d98fb4e2e4ea9739d7e0a43c760fea92f4c32a0accb511f72cfad022fc053b2","observation_id":"b7bf0901-9ef4-4e75-ae12-5ae45a7e43bf","resolution":{"observed_at":"2026-08-01T19:49:21.728964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:21.852204Z","title":"The loss surfaces of multi- layer networks.Journal of Machine Learning Research, 38: 192–204, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:21.852204Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:d2d829591b8b1350a4b041101e507ae9f5f50db621759f77a1e6ead9870d38d0","observation_id":"836cf301-42ec-415f-8809-31b7d9fe05af","resolution":{"observed_at":"2026-08-01T19:49:21.852204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:21.951915Z","title":"Assessment of local influence.Journal of the Royal Statistical Society Series B: Statistical Methodology, 48(2):133–155, 1986","venue":null,"work_id":null,"year":1986},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:21.951915Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:cdd594a0a78abaf3e56ddbcc43b13b9cdd0500258e9859204fccc7485db13f7c","observation_id":"c3acaa23-037b-48c4-b888-4112c9fc1d62","resolution":{"observed_at":"2026-08-01T19:49:21.951915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:22.037226Z","title":"Scaling up dataset distillation to imagenet-1k with constant memory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:22.037226Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:210a6fee6afa078d40ee7755d246ab8ea0029ed9bd4a7b193eb91e87fa44d8fc","observation_id":"975ffc7d-f499-428a-93e8-f997ed60e9a4","resolution":{"observed_at":"2026-08-01T19:49:22.037226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:22.105540Z","title":"Iden- tifying and attacking the saddle point problem in high- dimensional non-convex optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:22.105540Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:f8c3ddbf74030cbdfca5c6726fc873858f6083fb237fad9474bd457432935923","observation_id":"77c2633c-ef95-4326-830f-2a5b0fb4712e","resolution":{"observed_at":"2026-08-01T19:49:22.105540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:22.195907Z","title":"Remember the past: Distilling datasets into addressable memories for neural net- works.Advances in Neural Information Processing Systems, 35:34391–34404, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:22.195907Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:27fb5fbcdbb7f91f0b955fb258253f426c845023bb60c274f137f291f061c256","observation_id":"092cef57-214f-4fb8-b54e-2e8e7b933aa5","resolution":{"observed_at":"2026-08-01T19:49:22.195907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-01T19:49:22.363338Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding.arXiv preprint arXiv:1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:22.363338Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:cfc50b76afe791de9c4d504ee37be8bf643f7cc5788187cdec96c4186fff8a52","observation_id":"1ca6d411-bccf-45f8-a653-cd842c82c6c9","resolution":{"observed_at":"2026-08-01T19:49:22.363338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:22.478865Z","title":"Privacy for free: How does dataset condensation help privacy? InInternational Conference on Machine Learning, pages 5378–5396","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:22.478865Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:de7b2b023b42419f7beb9f21908f52e41f5b124ed87c27d0d9eef6b8551f3cfb","observation_id":"cf874c07-f478-4331-ba56-1056ffe942d0","resolution":{"observed_at":"2026-08-01T19:49:22.478865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:22.575608Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale.ICLR, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:22.575608Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:3aca68e5d6644e6f1792406fae2dcc4824f65348a2867dec48590c93f3836fdb","observation_id":"3460be37-79e1-429b-8711-6c5bf564e8f3","resolution":{"observed_at":"2026-08-01T19:49:22.575608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:22.750551Z","title":"Minimizing the accumulated trajectory error to improve dataset distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:22.750551Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:cc30adef91b4235defe4e9a9728f4a464e855b99c51c84f46b69cf15638a4657","observation_id":"461538f7-ac17-4e9e-b9f2-ea9611dd22ee","resolution":{"observed_at":"2026-08-01T19:49:22.750551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:22.859735Z","title":"Sequential subset matching for dataset distillation.Advances in Neural Infor- mation Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:22.859735Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:18c89a217f044dc00905e6fe79585448a67dd04b8cf379609083f3229e7ec39f","observation_id":"c53e610e-c5b7-4f22-a6d8-b81f48e2bae6","resolution":{"observed_at":"2026-08-01T19:49:22.859735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:22.938508Z","title":"Embarrassingly simple dataset distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:22.938508Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:13cebb67b86efd257eff74078d2c8fde6d0a6e149c0a82867a186c7dd0bb3416","observation_id":"a96a097a-d984-49fd-844f-c8cd6abe1f4f","resolution":{"observed_at":"2026-08-01T19:49:22.938508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-07-06T16:03:14.694457Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-01T19:49:23.021717Z","title":"Studying large language model generalization with influence functions.arXiv preprint arXiv:2308.03296, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:23.021717Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:b07904f43fca4d61a38f1d80312e039b3f55a6196ee270b47e214e985eb9e7cc","observation_id":"76d40b8f-0378-406f-91dc-8bc758ff267d","resolution":{"observed_at":"2026-08-01T19:49:23.021717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16645","last_updated":"2024-01-09T06:16:01Z","snapshot_observed_at":"2026-07-30T21:08:39.026853Z","submitted_at":"2023-05-26T05:31:51Z","title":"Summarizing Stream Data for Memory-Constrained Online Continual Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16645","snapshot_observed_at":"2026-08-01T19:49:23.104993Z","title":"Sum- marizing stream data for memory-restricted online continual learning.arXiv preprint arXiv:2305.16645, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:23.104993Z"},"links":{"cited_paper":"/paper/2305.16645","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:a0537ddf6d853843b20710c56b717dce68a4bd37677af6d70f879e330c8ac067","observation_id":"6b37a238-783e-47b4-afdb-b736eb8979f9","resolution":{"observed_at":"2026-08-01T19:49:23.104993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05773","last_updated":"2024-03-18T11:44:06Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:57:41Z","title":"Towards Lossless Dataset Distillation via Difficulty-Aligned Trajectory Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05773","snapshot_observed_at":"2026-08-01T19:49:23.223662Z","title":"Towards lossless dataset distillation via difficulty-aligned trajectory matching.arXiv preprint arXiv:2310.05773, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:23.223662Z"},"links":{"cited_paper":"/paper/2310.05773","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:c71bfa1e18b508307daa5f15ed9193582fed6e84248ee4275323dbe15904c7f1","observation_id":"e8689628-dbef-4007-b3ca-bba7c47edcc5","resolution":{"observed_at":"2026-08-01T19:49:23.223662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04612","last_updated":"2024-03-29T21:33:29Z","snapshot_observed_at":"2026-07-06T14:28:33.053942Z","submitted_at":"2022-12-09T00:32:46Z","title":"Training Data Influence Analysis and Estimation: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04612","snapshot_observed_at":"2026-08-01T19:49:23.314285Z","title":"Training data influ- ence analysis and estimation: A survey.arXiv preprint arXiv:2212.04612, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:23.314285Z"},"links":{"cited_paper":"/paper/2212.04612","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:a3e2ba240394dd4d7e2c1163d0764658a6268a918cc719242e1f22fa8b17e21e","observation_id":"47a0272b-c6df-437a-a999-0609b1f00ccc","resolution":{"observed_at":"2026-08-01T19:49:23.314285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:23.396380Z","title":"Data cleansing for models trained with sgd.Advances in Neural Information Processing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:23.396380Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:002a9fc143514433cb00344271b2c9f5aa35c8fa3dee1e0edfc8e0b4fe2919e1","observation_id":"3b4bbb79-146d-462a-b2e9-dc41e9c430a6","resolution":{"observed_at":"2026-08-01T19:49:23.396380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:23.520819Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:23.520819Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:8ade7fa826cd7ac57b8947e5caea190849c393f39689aceaef082c9172158b1b","observation_id":"e3c608f2-73a2-4cfb-bce4-96c93dc3a0b4","resolution":{"observed_at":"2026-08-01T19:49:23.520819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:23.648507Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:23.648507Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:7e72b9f31486ed710cc2da60b7fceaba4fc33b68d46d3e1827e624d4b30f8c72","observation_id":"770a2f6f-6a7e-44a3-ba86-ca080ef2647d","resolution":{"observed_at":"2026-08-01T19:49:23.648507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:23.746646Z","title":"Understanding black-box pre- dictions via influence functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:23.746646Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:f84c2f65cea5261cb1956d579687facf18b7c9212c15ce495decb4f1c954907d","observation_id":"0e49d098-1b06-4426-bb7d-bb781f85ec09","resolution":{"observed_at":"2026-08-01T19:49:23.746646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:23.852726Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:23.852726Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:302064e491468d5c14fa5c5645d955929fa6a894d884a4ee54eb0104fb7fc6a8","observation_id":"2668f4fd-a928-4031-82ca-420cf248da28","resolution":{"observed_at":"2026-08-01T19:49:23.852726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00902","last_updated":"2024-03-13T14:27:46Z","snapshot_observed_at":"2026-08-05T00:50:30.348219Z","submitted_at":"2023-10-02T04:59:19Z","title":"DataInf: Efficiently Estimating Data Influence in LoRA-tuned LLMs and Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00902","snapshot_observed_at":"2026-08-01T19:49:24.018437Z","title":"Datainf: Efficiently estimating data influence in lora-tuned llms and diffusion models.arXiv preprint arXiv:2310.00902,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:24.018437Z"},"links":{"cited_paper":"/paper/2310.00902","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:6c164f58918aa105a1cbcfb2ad31e1ae693aee87b96fd08aa9c9ce1df17b53b8","observation_id":"306768cd-e2ae-447f-9207-16cc177f9a01","resolution":{"observed_at":"2026-08-01T19:49:24.018437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:24.184671Z","title":"Lecun, L","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:24.184671Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:35c4451536ed36d3f9ca926497999f86292a1a839c9c7d2b1bcee97a59dbfff1","observation_id":"6c2c4b64-65fa-4c88-9e89-381498abc2f2","resolution":{"observed_at":"2026-08-01T19:49:24.184671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:24.304328Z","title":"Awesome dataset distillation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:24.304328Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:23ab28c8976083d06b48531422371eb2e0c8ea53b7a7bb4c080a9b966661b134","observation_id":"c69c1ac0-db15-4d8d-9930-19a2bbdbfcea","resolution":{"observed_at":"2026-08-01T19:49:24.304328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:24.467094Z","title":"Mars3d: A plug-and-play motion- aware model for semantic segmentation on multi-scan 3d point clouds","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:24.467094Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:d8e2f9f62e86705f8601d52def86053d3a48a3c989d141a423fb78f0896dbc0b","observation_id":"e8ca8f30-7f87-4fc7-9c6d-dc8409080e01","resolution":{"observed_at":"2026-08-01T19:49:24.467094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:24.587511Z","title":"Very deep convolutional neural network based image classification using small training sample size","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:24.587511Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:d59a31ca6df80aff8dbd743a4c9e1fbc0b225012686b0c50477b698eb721bd33","observation_id":"c78983c8-41ee-4bc4-ae91-c7d0b7fc473f","resolution":{"observed_at":"2026-08-01T19:49:24.587511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:24.720965Z","title":"Efficient dataset distillation using random feature approxima- tion.Advances in Neural Information Processing Systems, 35:13877–13891, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:24.720965Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:ad49548e9e9bcf37ec5cbbfcf2490d9607c09674af060af3584f621df708eeea","observation_id":"018d64d9-12ea-4e53-947d-145726717bd0","resolution":{"observed_at":"2026-08-01T19:49:24.720965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:24.870744Z","title":"Herding dynamical weights to learn","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:24.870744Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:15dfd9fdeb2cdd99b3ed8dce19863016bb6825fa353ade95584fa7143b9a5b3f","observation_id":"ddd41453-4402-4ac7-a7dc-8206e87a6892","resolution":{"observed_at":"2026-08-01T19:49:24.870744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:24.999164Z","title":"Dataset meta-learning from kernel ridge-regression","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:24.999164Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:8c10093a39b0302feefda2b5436507d7206b8a355063687423b12acb16442bec","observation_id":"53d75f08-b5f9-4601-91f4-73f6d78c0569","resolution":{"observed_at":"2026-08-01T19:49:24.999164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:25.104371Z","title":"Pearlmutter","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:25.104371Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:dcc92fdd0fb59d954eac3d9e9abafb5783fdec46ab049542853a062511428c16","observation_id":"b6c76450-281c-4ef6-b4cf-f97cb34147c6","resolution":{"observed_at":"2026-08-01T19:49:25.104371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:25.259185Z","title":"Flickr30k entities: Collecting region-to-phrase correspon- dences for richer image-to-sentence models","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:25.259185Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:fd9c825a766a7b0d0f5db1d48026a0c9364a48ece4bfe9350db9f238294088a4","observation_id":"fa8e7fe4-6ec6-4a50-97c3-fb230245038e","resolution":{"observed_at":"2026-08-01T19:49:25.259185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.08484","last_updated":"2020-11-14T18:47:35Z","snapshot_observed_at":"2026-07-06T08:58:39.542748Z","submitted_at":"2020-02-19T22:40:32Z","title":"Estimating Training Data Influence by Tracing Gradient Descent","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.08484","snapshot_observed_at":"2026-08-01T19:49:25.386620Z","title":"Estimating training data influence by tracing gradient descent.arXiv preprint arXiv:2002.08484, 2020","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:25.386620Z"},"links":{"cited_paper":"/paper/2002.08484","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:8e3bb20b59f431b8227415273dc608733b9519df4e9324efc9c29eac1844c499","observation_id":"80ed8efe-3b24-45f2-807e-4eba225cedd1","resolution":{"observed_at":"2026-08-01T19:49:25.386620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:25.475450Z","title":"Datadam: Efficient dataset distillation with attention matching","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:25.475450Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:62a147b1b4fc8921cebd05e7da6a90f7ce19c070e4125cc2c6730162827c1f80","observation_id":"cce01f84-efa9-4724-977e-06e2b3c1b923","resolution":{"observed_at":"2026-08-01T19:49:25.475450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:25.543473Z","title":"Scaling up influence functions","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:25.543473Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:9b82e197c7ee038f7a30b634fa81f4dc72c8693b4fe9d047379176b21b1b6c19","observation_id":"f3a888e5-d854-432e-a09d-1e717de8e62f","resolution":{"observed_at":"2026-08-01T19:49:25.543473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:25.670141Z","title":"Theoretical and practical perspectives on what influence functions do.Advances in Neural Information Pro- cessing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:25.670141Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:cb628b75194fcda1654f9e4d8170ad042855ea06509f87b0b6c34514967e32f0","observation_id":"2f896dfb-3be5-48b2-a71f-77c856631cb3","resolution":{"observed_at":"2026-08-01T19:49:25.670141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:25.760206Z","title":"A value for n-person games","venue":null,"work_id":null,"year":1953},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:25.760206Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:503fb55a0aa6ffede2d3c2e382e0623539e81f7afb05a58c2e5ac355746d42cb","observation_id":"cc96d57c-4b85-4872-8c9c-dd3938ea91a7","resolution":{"observed_at":"2026-08-01T19:49:25.760206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17950","last_updated":"2024-03-17T03:56:13Z","snapshot_observed_at":"2026-08-03T14:57:06.849547Z","submitted_at":"2023-11-29T06:25:59Z","title":"Generalized Large-Scale Data Condensation via Various Backbone and Statistical Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17950","snapshot_observed_at":"2026-08-01T19:49:25.848163Z","title":"Generalized large-scale data condensation via var- ious backbone and statistical matching.arXiv preprint arXiv:2311.17950, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:25.848163Z"},"links":{"cited_paper":"/paper/2311.17950","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:dbde620cf037c575ec5c01f0931d04008c1adcea0e314a2c82d89d1dbcf9ec84","observation_id":"d74119ce-4eca-4ee4-b067-18df8475c5db","resolution":{"observed_at":"2026-08-01T19:49:25.848163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:25.907618Z","title":"Soft-label dataset distillation and text dataset distillation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:25.907618Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:cbffe81b25018952b9b6db165ef020a27aa3859812beef34fe6d484c7a95bad0","observation_id":"1ce0fdd0-e51f-4b33-a832-bafd3d9897f2","resolution":{"observed_at":"2026-08-01T19:49:25.907618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03526","last_updated":"2024-03-19T08:03:07Z","snapshot_observed_at":"2026-07-06T16:57:46.724781Z","submitted_at":"2023-12-06T14:40:05Z","title":"On the Diversity and Realism of Distilled Dataset: An Efficient Dataset Distillation Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03526","snapshot_observed_at":"2026-08-01T19:49:26.055517Z","title":"On the diversity and realism of distilled dataset: An efficient dataset distilla- tion paradigm.arXiv preprint arXiv:2312.03526, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:26.055517Z"},"links":{"cited_paper":"/paper/2312.03526","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:fdde08b01e87dd7bfd3a449ff328f0f1985c9ae069280987c7602532d3f7e8aa","observation_id":"441a0324-9876-49d6-ada0-cddeeddcd0bc","resolution":{"observed_at":"2026-08-01T19:49:26.055517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:26.204521Z","title":"Data pruning via moving-one- sample-out","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:26.204521Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:51aebbe1b52e0fa3db0a73e99c53849c6b7f92eb83f2cbbda4299f95f9bbb6e7","observation_id":"2ac0803b-5029-4f00-904e-b6a559c67d38","resolution":{"observed_at":"2026-08-01T19:49:26.204521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:26.324502Z","title":"Understanding data influence with differential approximation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:26.324502Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:03c1d13803f3e4c0b2f2b13f0773f316cd4244f2917b63b0d643c3d0b1bbfb2d","observation_id":"8801f3d7-5b01-4e58-9b7d-3aa941d9e708","resolution":{"observed_at":"2026-08-01T19:49:26.324502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:26.447256Z","title":"Understanding data influence in reinforcement finetuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:26.447256Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:99dc5dd5d90e1c5f40a2c2552ea31b4d939d5664e687e893711755c93207f45d","observation_id":"8cef67ca-9a50-43d2-98a9-779807e9b1c7","resolution":{"observed_at":"2026-08-01T19:49:26.447256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:26.517411Z","title":"Cafe: Learning to condense dataset by align- ing features","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:26.517411Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:20f611589e3b20a6adcda68b75c92d5d8cc1929279042f25f57aaeb7bed1cdfc","observation_id":"12db354b-e0e0-48c0-89a6-b0a365863da0","resolution":{"observed_at":"2026-08-01T19:49:26.517411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04707","last_updated":"2023-10-11T11:30:32Z","snapshot_observed_at":"2026-07-06T15:00:17.108271Z","submitted_at":"2023-03-08T16:48:24Z","title":"DiM: Distilling Dataset into Generative Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04707","snapshot_observed_at":"2026-08-01T19:49:26.598542Z","title":"Dim: Distilling dataset into generative model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:26.598542Z"},"links":{"cited_paper":"/paper/2303.04707","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:258eb3564c8b662cadd945ddf4545b7e8bff1be362ae5654e9534efaff943fbb","observation_id":"2eb0d057-8e57-4e71-a991-97ee812ae779","resolution":{"observed_at":"2026-08-01T19:49:26.598542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:26.697391Z","title":"Dataset distil- lation with neural characteristic function: A minmax perspec- tive, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:26.697391Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:d12176562d73d9ea34faf5479b44f5a502f9d07d6fe11cb2fe33f380e728197a","observation_id":"28430e8f-5e46-4cea-9667-d3f91388ef57","resolution":{"observed_at":"2026-08-01T19:49:26.697391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.10959","last_updated":"2020-02-24T23:25:50Z","snapshot_observed_at":"2026-07-06T07:17:20.813296Z","submitted_at":"2018-11-27T13:17:45Z","title":"Dataset Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.10959","snapshot_observed_at":"2026-08-01T19:49:26.783420Z","title":"Dataset distillation.arXiv preprint arXiv:1811.10959, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:26.783420Z"},"links":{"cited_paper":"/paper/1811.10959","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:8ba2c826cc66a2761ee3a05b24d743d96ee50e1d59bc65ea7d68663381c97f1d","observation_id":"d24a4a77-3688-4054-a729-2c4b51a5474a","resolution":{"observed_at":"2026-08-01T19:49:26.783420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:26.870666Z","title":"Saco loss: Sample-wise affinity consistency for vision-language pre-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:26.870666Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:64bf8ada5c99d5aeea96195c9dd491efcd2205124baeca481b85352ff0f31f3f","observation_id":"1317d831-5eb3-446c-a4b3-6ffd8a455810","resolution":{"observed_at":"2026-08-01T19:49:26.870666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:27.034776Z","title":"Mixture- of-scores: Robust image-text data valuation via three lines of code","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:27.034776Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:f2c7ccb01e02a5b946ac5a7e88b810ebdabc86c17a8190c8f4a334becdd0ccac","observation_id":"1b8908d7-dacc-47d2-8115-0e734121e761","resolution":{"observed_at":"2026-08-01T19:49:27.034776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07545","last_updated":"2024-08-20T14:59:55Z","snapshot_observed_at":"2026-08-02T13:00:05.823222Z","submitted_at":"2023-08-15T03:22:40Z","title":"Vision-Language Dataset Distillation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07545","snapshot_observed_at":"2026-08-01T19:49:27.157680Z","title":"Multimodal dataset distillation for image-text re- trieval.arXiv preprint arXiv:2308.07545, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:27.157680Z"},"links":{"cited_paper":"/paper/2308.07545","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:7ea6d4641d28472fccf1ae141a780dfc670768fde40baed58b0a8d57d5c72a9f","observation_id":"8aadeb01-ae29-4495-a6f8-35df6eb472ee","resolution":{"observed_at":"2026-08-01T19:49:27.157680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:27.287408Z","title":"Dreamomni2: Multimodal instruction-based editing and generation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:27.287408Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:4aaecbe0dac312bd99074f15c4a9a4098ed7ec99108819c95f18473071cbd007","observation_id":"ebb5280d-b2df-4cb0-90cc-4b4439e44744","resolution":{"observed_at":"2026-08-01T19:49:27.287408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:27.459472Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:27.459472Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:6ec2f90782570b222ca1caad4f470139e90abad656aa86c9f538d24f04ccb6cc","observation_id":"50bc4e48-7ad6-4eb9-9e27-29334ba4b777","resolution":{"observed_at":"2026-08-01T19:49:27.459472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:27.633163Z","title":"An efficient dataset condensation plugin and its application to continual learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:27.633163Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:05dda4ee27a475b61f2bdb87f4a2799795a3b6a2d5ab05ee7004a7ea8b3af57f","observation_id":"99af39e1-4063-469a-b97a-28919c50b77d","resolution":{"observed_at":"2026-08-01T19:49:27.633163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:27.800244Z","title":"Dataset pruning: Reducing training data by ex- amining generalization influence","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:27.800244Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:16ee64602e6e351dfd897965ab286fb65ee77f7c9d78ec5e65751d49b2710a44","observation_id":"ded58d32-475c-4b4a-b155-404fb8c6aac7","resolution":{"observed_at":"2026-08-01T19:49:27.800244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:27.987345Z","title":"Squeeze, recover and relabel: Dataset condensation at imagenet scale from a new perspective.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:27.987345Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:40b716c92ddc57a9d7bc8aa0957e0489464becb6e54f8950d9f25bbcf6795d18","observation_id":"e3d13878-e8cb-495e-8722-f396671c2578","resolution":{"observed_at":"2026-08-01T19:49:27.987345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07698","last_updated":"2023-09-14T13:17:02Z","snapshot_observed_at":"2026-08-04T14:55:23.529476Z","submitted_at":"2023-09-14T13:17:02Z","title":"Dataset Condensation via Generative Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07698","snapshot_observed_at":"2026-08-01T19:49:28.099828Z","title":"Dataset condensation via generative model.arXiv preprint arXiv:2309.07698, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:28.099828Z"},"links":{"cited_paper":"/paper/2309.07698","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:04a282923685459717f3cc2f063e520a4e52201113baf1691069a6e6c06f0dab","observation_id":"67829859-806e-4e9b-b34d-4a255ff13aca","resolution":{"observed_at":"2026-08-01T19:49:28.099828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:28.277353Z","title":"M3d: Dataset condensation by minimizing maximum mean discrepancy","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:28.277353Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:4872b2b5fb560eba2ef983a8f64bd13be58d39f07ba21f9c55f7a0fc21ccb94e","observation_id":"36f572a1-3b09-4438-9719-8efd4cd1e775","resolution":{"observed_at":"2026-08-01T19:49:28.277353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.04181","last_updated":"2022-12-22T02:50:07Z","snapshot_observed_at":"2026-07-06T11:55:53.527777Z","submitted_at":"2021-10-08T15:02:30Z","title":"Dataset Condensation with Distribution Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.04181","snapshot_observed_at":"2026-08-01T19:49:28.422760Z","title":"Dataset condensation with distri- bution matching.arXiv preprint arXiv:2110.04181, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:28.422760Z"},"links":{"cited_paper":"/paper/2110.04181","citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:25216d13a0cff63c8427967720f177115cdae373ee12c1aa359588b17bc50a05","observation_id":"dfb48346-1531-486c-86d8-0bd02f11cc7b","resolution":{"observed_at":"2026-08-01T19:49:28.422760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:28.561108Z","title":"Dataset condensation with differ- entiable siamese augmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:28.561108Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:277d183da6a8305f2de79235ec15dcd20eb041662c6fad4a2d86bfecbd001ccc","observation_id":"e4e355b4-57fc-4b06-a86f-93705fee46a7","resolution":{"observed_at":"2026-08-01T19:49:28.561108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:28.735929Z","title":"Dataset condensation with gradient matching","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:28.735929Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:180f1a386eca0f11d733c243e6e5cc5132316403e724eb6de985a7603ed72ea1","observation_id":"f93bec7d-f885-436b-9668-302e605fe255","resolution":{"observed_at":"2026-08-01T19:49:28.735929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:28.905657Z","title":"Im- proved distribution matching for dataset condensation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:28.905657Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:e53d1ad2468656beee5106a5cd89246db67b355cf2c0e2c7b0c05617306a2a70","observation_id":"f6af7f6c-152e-4828-a446-c8b2a46843e8","resolution":{"observed_at":"2026-08-01T19:49:28.905657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:29.011485Z","title":"Equipping vision foundation model with mixture of experts for out-of-distribution detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:29.011485Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:25cea4c82ff4e3d3f66e2027524f8d699cb5d1d63136e5b7d10e2782eb033ae2","observation_id":"016c0f35-4930-4bfd-bb66-fc702aa533a2","resolution":{"observed_at":"2026-08-01T19:49:29.011485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T19:49:29.111971Z","title":"Dataset distillation using neural feature regression.Advances in Neu- ral Information Processing Systems, 35:9813–9827, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-01T19:49:29.111971Z"},"links":{"citing_paper":"/paper/2607.16859"},"observation_digest":"sha256:62c7671743f31b3432fe5f9a1ac9e1709d6f684f0a1834c629fca4325d50fd49","observation_id":"2b4fc1a1-796e-4aa2-bda4-96cce3630599","resolution":{"observed_at":"2026-08-01T19:49:29.111971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.16859","last_updated":"2026-07-18T15:47:03Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-01T19:49:19.386440Z","submitted_at":"2026-07-18T15:47:03Z","title":"Dataset Distillation by Influence Matching"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":71,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 0 inbound Pith citation observations for arXiv:2607.16859."}