{"as_of":"2026-08-09T20:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:68c0f9353010ccbffb5ade3df2603751bb6c46cce10d0fd3ea9428bb6c09065a","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T20:55:11.027028Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2603.14830/citation-record","integrity":"/paper/2603.14830/integrity","json":"/paper/2603.14830/citation-record.json","paper":"/paper/2603.14830"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1811.10959","last_updated":"2020-02-24T23:25:50Z","snapshot_observed_at":"2026-07-06T07:17:20.813296Z","submitted_at":"2018-11-27T13:17:45Z","title":"Dataset Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.10959","snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Dataset distillation.arXiv preprint arXiv:1811.10959,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"cited_paper":"/paper/1811.10959","citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:c5a0e2f3ff3e840a6fd69ea110b6b7e4d70052bdd39d69b36c84fdf3a97c1ad1","observation_id":"b27e129f-135d-4f49-bef8-fe761d18d523","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Guang Li, Ren Togo, Takahiro Ogawa, and Miki Haseyama","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:bff1b949150b39841b884dbed5545db93aa0447fa148103a515c02b5b8c7b8b1","observation_id":"3c21b861-4da7-4d62-b34a-c78b80bfd7fa","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"2020.9191357","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:8c481051cb1849c1003737968a2366fe02b5914fa985005490fb26b0854f50d4","observation_id":"be0dbcf7-5f7b-44a6-b6ad-1b355744680e","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-4072","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Hanfei Guo, Junhao Xu, Chang Li, Wei Zhao, Hu Peng, Zhihui Han, Yuanguo Wang, and Xun Chen","venue":null,"work_id":"65ee80ba-0947-4543-b2e1-88dd66432a72","year":null},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:b2747c837ff18897c8333bf2c5db0d41f69826bac83694be31681789d3bdc0c6","observation_id":"04ff2851-ca92-4222-8ee6-671876caafaa","resolution":{"observed_at":"2026-07-14T21:00:45.570800Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15372","last_updated":"2024-10-20T12:13:32Z","snapshot_observed_at":"2026-08-08T19:31:22.273054Z","submitted_at":"2024-10-20T12:13:32Z","title":"Hybrid Memory Replay: Blending Real and Distilled Data for Class Incremental Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15372","snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Hybrid memory replay: Blending real and distilled data for class incremental learning.arXiv preprint arXiv:2410.15372,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"cited_paper":"/paper/2410.15372","citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:82e307afceb29ce35114c9a0ebdc0b032e13afbb635b7c22813d28b83fe8f5b5","observation_id":"aa061007-b48d-45f2-a8cd-d6ea85c0d5d8","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.07999","last_updated":"2021-06-06T06:55:46Z","snapshot_observed_at":"2026-07-06T09:56:19.448798Z","submitted_at":"2020-09-17T01:14:47Z","title":"Distilled One-Shot Federated Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.07999","snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Distilled one-shot federated learning.arXiv preprint arXiv:2009.07999,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"cited_paper":"/paper/2009.07999","citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:cc6d968fab4f1823abade6508d22dd6e2eee060021bfdaf742de8fdf03e4455c","observation_id":"6c6e414a-78fa-4311-8848-e7c584164688","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"A theoretical study of dataset distillation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:f82ea6b8f24888bf675e21ece63275b4579ff794858350ce3863b26b6083a913","observation_id":"22ced8c0-0803-468b-a80d-ca84ac8c10d7","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-2816","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Provable and efficient dataset distillation for kernel ridge regression","venue":null,"work_id":"ebde0e0e-5442-4085-8fc0-5078a7202fde","year":null},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:2336bc419c3a3274b64f7324d06695f42a26a0d2d548499047f17b617cf9e427","observation_id":"896afd2f-9748-4978-ae45-399771c3eadc","resolution":{"observed_at":"2026-07-14T21:00:45.565515Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.332337","doi":"10.1109/tpami.2023.3323376","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Timothy Nguyen, Zhourong Chen, and Jaehoon Lee","venue":"IEEE Transactions on Pattern Analysis and Machine Intelligence","work_id":"de307091-7752-47ff-bd13-54174110408c","year":2023},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:9d3f2223a32d89f9ff5653dff7c7e4625523327a17b3e264f342eeb74fa836dd","observation_id":"42ecc9ea-0c65-4fbb-b3ac-c4cdbf0cf2a8","resolution":{"observed_at":"2026-07-14T21:00:45.567556Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Justin Cui, Ruochen Wang, Si Si, and Cho-Jui Hsieh","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:70b077476ebe8b65a619388848dc153b5d1dad9bae13bf400be4d2cffda9d3d0","observation_id":"f8a9d480-4683-442d-9c0d-11c907a06238","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Data distillation can be like vodka: Distilling more times for better quality","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:28af4322a4dcea377e2f27ea9a664affdb4a362c3ab2bd9278a4b0594e83c20e","observation_id":"bfe539d0-84f2-4625-9161-9cd58fa43007","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.11904","last_updated":"2020-08-27T03:58:11Z","snapshot_observed_at":"2026-08-06T06:11:05.909628Z","submitted_at":"2020-08-27T03:58:11Z","title":"A Precise Performance Analysis of Learning with Random Features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.11904","snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"A precise performance analysis of learning with random features.arXiv preprint arXiv:2008.11904,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"cited_paper":"/paper/2008.11904","citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:e049d44ff2199cab82fbad7778f695538d9523f8e06aa618ce71fadea085c027","observation_id":"d2fe77bd-ae7d-4f94-8e33-d36bf32ef225","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19793","last_updated":"2023-11-02T17:33:13Z","snapshot_observed_at":"2026-08-04T08:51:40.592790Z","submitted_at":"2023-10-30T17:55:28Z","title":"On Learning Gaussian Multi-index Models with Gradient Flow","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19793","snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"On learning gaussian multi-index models with gradient flow","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"cited_paper":"/paper/2310.19793","citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:87fc00393c0c1b27c534106bfe7e2e1c90b8ca07d2ac6533d4d59c9e88e398e3","observation_id":"16e48971-a956-4474-8dfc-7d64d201ee96","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:696ebabb6b0ef987342217f298cac9e92673f133e76cf37ed4d28760ae39f082","observation_id":"18ebb3ba-18fe-4eb2-8cc3-b44bf3d64cf8","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:5b8247e8c2e9eaf1605dfd829e6c501d383f101adf8f1e80c03557dff7c9a94e","observation_id":"b056dbea-9e0a-4075-a63e-d683980ea4f8","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Moreover, in Appendix C, we will treat a well-defined update for ReLU, which will also lead to similar result shown in this appendix","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:5001d6fc7335502098f0942bf01b71f7cb03f1c20d3446aeb3c517476cd32dd8","observation_id":"9afb0223-b062-40b8-b7ca-ecd26194d275","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"We define the first term of the right hand side as∆1,1 and the second as∆ 1,2","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:0b39763c0eb35e72e3f0422adbbd5617aee0134093c8fe64d0a020ed46b4fc5d","observation_id":"6fb3343c-60cb-4498-99be-90e224843a03","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"(2022), we know that with high probability, sup w∈S��� ����� 1 N � n ˆf ∗(xn)xnσ′(�wj, xn�)�� x � ˆf ∗(x)xσ′(�wj, x�) ������ = ˜O � � d N �","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:b47195cd93eda4f86ca23850d8b1be332bef05b95a3da13808856ee68418f20f","observation_id":"5022e286-099e-4e4f-98db-40afc452c362","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Finally, we can prove Theorem B.4","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:f21554f493b9b9c11a768a36c1c49c52be6fb65a046def965d7ec841d1d0b84d","observation_id":"e51990a8-a899-40d6-aa16-ec2efc7ab540","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"B.5.2 Proof of Theorem B.29 Lemma B.30(Lemma 23 from Nishikawa et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:3d87b1a203906dff71f21f9dc2c150efab36d094f22849f51e427291dc4741d1","observation_id":"c5ea51dc-0678-4e5f-a7ca-fc341ffb9e6f","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"We will first evaluate conditions onηR 1 , ηD 1 , N and J ∗ =LJ/2 to satisfy conditions P= ˜Θ(1) and c(x) =o d(Plog −2p+2 d) of Lemma B.30","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:769686e2bdd57123a5b9925061e82c8fa6baa371b9b09324db7483d71eea06ff","observation_id":"30eaab3d-f9df-4d75-806c-9c7b27f83a9e","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Moreover, �β, w�=st+ � 1�t 2�β⊥, v�, where s=�β,˜x� , and β⊥ =β� �β,˜x�˜x","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:64201629ddbb9cd221bcd36a94b9018b0fc4bc502a62c1e714134f97b7c70a3d","observation_id":"2137dd36-ba94-4d68-828a-7920a5c637a6","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"Let us now move on to proving our main statements","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:27e74e76e860e7b6169aae8d58595622380f227f0027d7f6295d68173fc2e63d","observation_id":"d644c653-8264-48cb-bcef-fbd9fde30400","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T20:55:11.027028Z","title":"(2022) to analyze the behavior of DD and show that the resulting distilled data provide high generalization performance at retraining","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T20:55:11.027028Z"},"links":{"citing_paper":"/paper/2603.14830"},"observation_digest":"sha256:b8597f534021cb2847a05a335b88f66af9874a02ba18417d970fe0c171925933","observation_id":"1c791ff7-0f30-4b25-9482-d4d7980638c1","resolution":{"observed_at":"2026-07-14T20:55:11.027028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.14830","last_updated":"2026-07-03T09:25:19Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T04:35:28.208886Z","submitted_at":"2026-03-16T05:14:34Z","title":"Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2603.14830."}