{"as_of":"2026-08-07T09:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:638d2844e9fd08473373a2c48790a57ba0cefa87abf0897840c91665f3c472c4","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:59:04.660958Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T17:54:31.856386Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T17:58:46.704232Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"cited_work":{"arxiv_id":"2506.15553","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.15553","snapshot_observed_at":"2026-07-03T17:58:46.704232Z","title":"X.; Yin, J","venue":null,"work_id":"8f751a22-8165-4ef7-aae2-18137cbfd201","year":null},"citing_paper":{"arxiv_id":"2607.01686","last_updated":"2026-07-02T04:27:45Z","snapshot_observed_at":"2026-08-02T22:27:38.007319Z","submitted_at":"2026-07-02T04:27:45Z","title":"WARP: Weight-Space Analysis for Recovering Training Data Portfolios","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-03T17:54:31.856386Z"},"links":{"cited_paper":"/paper/2506.15553","citing_paper":"/paper/2607.01686"},"observation_digest":"sha256:061653ef2bbf19137f5f6a2c94ff1908b9ab27ff9ab86d6d5dda04eb7fdf70c2","observation_id":"73d46ce7-8313-4b21-9bf5-ead3aaaaf5d2","resolution":{"observed_at":"2026-07-03T17:58:46.706324Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.15553/citation-record","integrity":"/paper/2506.15553/integrity","json":"/paper/2506.15553/citation-record.json","paper":"/paper/2506.15553"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:58:57.897397Z","title":"Dbpedia: A nucleus for a web of open data, 2007","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:57.897397Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:669539684ef8486a300bf1845cb9afbdb44f4d77aa252f7b5f16fb6d046ce678","observation_id":"fdfa3b40-b820-4042-98e4-bace57be755b","resolution":{"observed_at":"2026-08-06T23:58:57.897397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-08-06T23:58:58.012122Z","title":"Ms marco: A human generated machine reading comprehension dataset, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.012122Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:691440960c5d45cdcfa57f9e364a16e9c96d10261453f1a555769283fce62d67","observation_id":"fbf335a2-7b14-4a0d-8c7d-e41ea3bc3db0","resolution":{"observed_at":"2026-08-06T23:58:58.012122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.04845","last_updated":"2022-04-25T12:53:14Z","snapshot_observed_at":"2026-07-06T12:27:02.281198Z","submitted_at":"2022-01-13T09:19:25Z","title":"Reconstructing Training Data with Informed Adversaries","version":2},"cited_work":{"arxiv_id":"2201.04845","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.04845","snapshot_observed_at":"2026-08-06T23:59:07.641212Z","title":"Reconstructing Training Data with Informed Adversaries","venue":"cs.CR","work_id":"577ac9be-3d62-4c91-9e80-b6cebe5ce9d6","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.113238Z"},"links":{"cited_paper":"/paper/2201.04845","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:2b8660d9c4ac712f69b9e311a8f54bfc8353aaa51df67c1e92443b0869fddc79","observation_id":"d5872ccb-fdce-452b-96e9-d7e21300b18f","resolution":{"observed_at":"2026-08-06T23:59:07.808516Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:09.507363Z","title":"Coresets via bilevel optimization for continual learning and streaming","venue":null,"work_id":"071f0b86-0647-41f8-aeb1-bf0be34bb9fc","year":2020},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.225141Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:0d987eadf5caab632e46b1ee71b1fd07fbacf638f39be707c7658291d97f3eed","observation_id":"882d2219-1c48-4406-b242-62e33507d74b","resolution":{"observed_at":"2026-08-06T23:59:09.607367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01827","last_updated":"2023-11-02T20:05:44Z","snapshot_observed_at":"2026-07-06T15:50:14.857449Z","submitted_at":"2023-07-04T17:09:49Z","title":"Deconstructing Data Reconstruction: Multiclass, Weight Decay and General Losses","version":2},"cited_work":{"arxiv_id":"2307.01827","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.01827","snapshot_observed_at":"2026-08-06T23:59:07.272228Z","title":"Deconstructing Data Reconstruction: Multiclass, Weight Decay and General Losses","venue":"cs.LG","work_id":"796cf2d6-e3f2-4ddc-9619-5e86b0e86202","year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.316530Z"},"links":{"cited_paper":"/paper/2307.01827","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:303c5a0a4e3cb3a1522fba398d537c9f20120d17532cc08d2e9136dcc5383c11","observation_id":"d6171dfb-ab40-4209-8f4d-a2f1c58727ca","resolution":{"observed_at":"2026-08-06T23:59:07.432903Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.07805","last_updated":"2021-06-15T17:45:26Z","snapshot_observed_at":"2026-08-06T17:18:50.002621Z","submitted_at":"2020-12-14T18:39:09Z","title":"Extracting Training Data from Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.07805","snapshot_observed_at":"2026-08-06T23:58:58.403904Z","title":"Extracting training data from large language models, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.403904Z"},"links":{"cited_paper":"/paper/2012.07805","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:27278043d8987d4fa93f0d0273c609b584f633c7ec2ecbef25b0ddbb0d2df3c0","observation_id":"63487873-dc3e-4722-88fe-87cac685c658","resolution":{"observed_at":"2026-08-06T23:58:58.403904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:58:58.545251Z","title":"Quantifying memorization across neural language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.545251Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:75df6065061d5d0af4495af17be4b5758605f373eae6d5c3c815c0fe35c02bb1","observation_id":"0517969b-9f8a-4e21-a65e-6da80e19aef2","resolution":{"observed_at":"2026-08-06T23:58:58.545251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06634","last_updated":"2024-07-09T17:44:00Z","snapshot_observed_at":"2026-07-06T17:42:33.242895Z","submitted_at":"2024-03-11T11:46:12Z","title":"Stealing Part of a Production Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06634","snapshot_observed_at":"2026-08-06T23:58:58.659790Z","title":"Feder Cooper, Katherine Lee, Matthew Jagielski, Milad Nasr, Arthur Conmy, Itay Yona, Eric Wallace, David Rolnick, and Florian Tramèr","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.659790Z"},"links":{"cited_paper":"/paper/2403.06634","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:0fb2826384f160d78537cdebb3633db7ae15c8baa1b601336a276ee9ff38834a","observation_id":"381bac5a-b44b-42a5-9686-fd745ce10bd0","resolution":{"observed_at":"2026-08-06T23:58:58.659790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11932","last_updated":"2022-03-22T17:58:59Z","snapshot_observed_at":"2026-08-03T13:37:02.393280Z","submitted_at":"2022-03-22T17:58:59Z","title":"Dataset Distillation by Matching Training Trajectories","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11932","snapshot_observed_at":"2026-08-06T23:58:58.787017Z","title":"Efros, and Jun-Yan Zhu","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.787017Z"},"links":{"cited_paper":"/paper/2203.11932","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:5f335eab232a38eebdfee2882121b1ff3b36f500789cb641563c1f7214582d4a","observation_id":"2e1c84ec-1c7a-4119-b983-1c025c8a6116","resolution":{"observed_at":"2026-08-06T23:58:58.787017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1203.3472","last_updated":"2012-03-15T11:17:56Z","snapshot_observed_at":"2026-07-06T02:44:38.546504Z","submitted_at":"2012-03-15T11:17:56Z","title":"Super-Samples from Kernel Herding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1203.3472","snapshot_observed_at":"2026-08-06T23:58:58.927044Z","title":"Super-samples from kernel herding","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:58.927044Z"},"links":{"cited_paper":"/paper/1203.3472","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:b25ed1e9e03ec50f8f2987a19f80c2f481c2df087d18d883345f5111d636065b","observation_id":"5b4e2cf0-fa80-4443-9f72-af8a22f73c3c","resolution":{"observed_at":"2026-08-06T23:58:58.927044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10586","last_updated":"2023-10-31T19:28:40Z","snapshot_observed_at":"2026-07-06T14:20:31.024052Z","submitted_at":"2022-11-19T04:46:03Z","title":"Scaling Up Dataset Distillation to ImageNet-1K with Constant Memory","version":4},"cited_work":{"arxiv_id":"2211.10586","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.10586","snapshot_observed_at":"2026-08-06T23:59:06.884929Z","title":"Scaling Up Dataset Distillation to ImageNet-1K with Constant Memory","venue":"cs.CV","work_id":"8bbb1a90-22ed-4918-a7c7-f3255b9c3a8c","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.037986Z"},"links":{"cited_paper":"/paper/2211.10586","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:6ab9be0e0cd948513503140eb2dfffa23e1b914764da1ea0ed6261952d31bca3","observation_id":"69f3cd9f-f318-4d54-8ef4-c16c60d02c69","resolution":{"observed_at":"2026-08-06T23:59:07.046779Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:58:59.183925Z","title":"Sinkhorn distances: Lightspeed computation of optimal transport","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.183925Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:0eb80ec7bd70578d84e17899f2285eb98db92a8d9e8e34925224ecb40651c9d6","observation_id":"335db460-6d08-44d7-be94-c37bd35296d1","resolution":{"observed_at":"2026-08-06T23:58:59.183925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:58:59.294471Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.294471Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:f61df4f64c969f26bc7791b6b6bb516b2a03abda056edae8c8a74cd5cff0b2bb","observation_id":"280a3a48-41d0-4ebc-967b-4e9ef647e72e","resolution":{"observed_at":"2026-08-06T23:58:59.294471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12926","last_updated":"2024-01-23T17:22:00Z","snapshot_observed_at":"2026-07-06T17:19:31.847730Z","submitted_at":"2024-01-23T17:22:00Z","title":"DsDm: Model-Aware Dataset Selection with Datamodels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12926","snapshot_observed_at":"2026-08-06T23:58:59.399365Z","title":"Dsdm: Model-aware dataset selection with datamodels, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.399365Z"},"links":{"cited_paper":"/paper/2401.12926","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:4d106febeca9820068e3f2d31dcdc04d7cb9ddf6a23e9d6fecf425a749ebb211","observation_id":"4de0d262-14d4-461d-9963-64712db86c6f","resolution":{"observed_at":"2026-08-06T23:58:59.399365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10951","last_updated":"2022-10-26T01:05:51Z","snapshot_observed_at":"2026-07-06T14:07:58.832663Z","submitted_at":"2022-10-20T01:45:02Z","title":"Automatic Document Selection for Efficient Encoder Pretraining","version":2},"cited_work":{"arxiv_id":"2210.10951","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.10951","snapshot_observed_at":"2026-08-06T23:59:06.556454Z","title":"Automatic Document Selection for Efficient Encoder Pretraining","venue":"cs.CL","work_id":"ddbc8037-3ee7-4196-b3f2-41b458f40923","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.498674Z"},"links":{"cited_paper":"/paper/2210.10951","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:05a0e6bc07821c33866ee896f890a541ca9a4e2770eeb29338bc6fa5acb47b15","observation_id":"049658bc-669e-46b3-bf0c-cbd2f98e67e4","resolution":{"observed_at":"2026-08-06T23:59:06.675641Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09539","last_updated":"2024-11-08T18:56:41Z","snapshot_observed_at":"2026-08-04T15:28:10.880179Z","submitted_at":"2024-03-14T16:27:49Z","title":"Logits of API-Protected LLMs Leak Proprietary Information","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09539","snapshot_observed_at":"2026-08-06T23:58:59.628645Z","title":"Logits of api-protected llms leak proprietary information, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.628645Z"},"links":{"cited_paper":"/paper/2403.09539","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:7be83bb9b79f294ffa123493c6d8161cf87c5d9e78a62d0c95fbf091730d15eb","observation_id":"ae09eb1b-53dd-426a-9948-9b070d39cd72","resolution":{"observed_at":"2026-08-06T23:58:59.628645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05773","last_updated":"2024-03-18T11:44:06Z","snapshot_observed_at":"2026-07-06T16:29:51.896529Z","submitted_at":"2023-10-09T14:57:41Z","title":"Towards Lossless Dataset Distillation via Difficulty-Aligned Trajectory Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05773","snapshot_observed_at":"2026-08-06T23:58:59.733364Z","title":"Towards lossless dataset distillation via difficulty-aligned trajectory matching, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.733364Z"},"links":{"cited_paper":"/paper/2310.05773","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:e8ae5b7bebc19adf116f7499f82580350696ff1b2b3fe664943128a23818b2a9","observation_id":"848806e4-4cf2-41f8-a7a8-4bdebfd89c33","resolution":{"observed_at":"2026-08-06T23:58:59.733364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07758","last_updated":"2022-12-05T14:49:34Z","snapshot_observed_at":"2026-08-03T07:41:48.597777Z","submitted_at":"2022-06-15T18:35:16Z","title":"Reconstructing Training Data from Trained Neural Networks","version":3},"cited_work":{"arxiv_id":"2206.07758","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.07758","snapshot_observed_at":"2026-08-06T23:59:06.257917Z","title":"Reconstructing Training Data from Trained Neural Networks","venue":"cs.LG","work_id":"7eeb19bb-7f68-40c0-ab6f-66b8f539abcd","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:58:59.848265Z"},"links":{"cited_paper":"/paper/2206.07758","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:97403c6d83e0c0ec4a5e06645d7cb0095d0ddf32f86a1da0ef42fe11045f6f97","observation_id":"30567002-d23c-401b-bd37-c7434841a361","resolution":{"observed_at":"2026-08-06T23:59:06.361080Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:00.004638Z","title":"Can we infer confidential properties of training data from llms?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.004638Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:df0c7abe5a2ea3ed36f5079400a3c134451f09cd717aa2c408b5874550acd96c","observation_id":"95c9a9b6-db3c-47f6-9ab2-acb73e48fa84","resolution":{"observed_at":"2026-08-06T23:59:00.004638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:09.277970Z","title":"D-optimality for regression designs: a review","venue":null,"work_id":"790f388f-ffed-4223-8d1c-4ae291861c3b","year":1975},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.151281Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:b3d84c8a70049cfb38108496a689bf091cc9b504b6ac33b2e9a44df619333d1a","observation_id":"58f4fcca-546c-42cb-81b8-087e72d355d0","resolution":{"observed_at":"2026-08-06T23:59:09.376383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:00.268925Z","title":"Johnson and Joram Lindenstrauss","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.268925Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:a6275674b3115bd757a825a83a02d126ba31c1c0343f3eed0c480d6162794a83","observation_id":"0e70ed92-8804-442b-b8dd-91421c4ce91f","resolution":{"observed_at":"2026-08-06T23:59:00.268925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:09.011051Z","title":"Grad-match: Gradient matching based data subset selection for efficient deep model training","venue":null,"work_id":"64d2dc4a-4c53-4ad6-802a-39a9d1b31fa9","year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.429419Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:bd6fc26c961fb45131434a608a71cfca940425be42e0b2c86e3651ac7a9b72fb","observation_id":"9718a7e9-6240-4b8d-9800-84734bcb4650","resolution":{"observed_at":"2026-08-06T23:59:09.132945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:08.797087Z","title":"Glister: Generalization based data subset selection for efficient and robust learning","venue":null,"work_id":"cbaad918-a99e-4bb9-be35-d4a8be748f9a","year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.583625Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:acf6d4bc75cf4668d626b4164cd7698f17804df385dc7649253696f1180195ce","observation_id":"ec40b26f-58ae-4bbb-ae88-64b6979cd733","resolution":{"observed_at":"2026-08-06T23:59:08.908064Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T23:59:00.718253Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.718253Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:031f58181017f6934e177bbf028d997199e73245d4aa57b90364e4029c5091d6","observation_id":"5fe28127-6b58-442a-b10b-b5e21a07d82e","resolution":{"observed_at":"2026-08-06T23:59:00.718253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:08.508824Z","title":"From word embeddings to document distances","venue":null,"work_id":"fc796dd0-087f-4947-bcaa-ffeac2d5e26b","year":2015},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:00.898223Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:413d59bc6114c50e28e385a522e024d16d3f15812fd5eb71c1507fc004e4224f","observation_id":"424fc9c5-e403-413d-a85c-c03467e1a799","resolution":{"observed_at":"2026-08-06T23:59:08.655593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:01.010339Z","title":"Dai, Jakob Uszkoreit, Quoc Le, and Slav Petrov","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.010339Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:16d14756583c8b79158b55a40992d4d149b2dcf317b7bd487f7c7a09bffad709","observation_id":"7e87c0ad-7046-49ad-a2ed-624b11c00dbb","resolution":{"observed_at":"2026-08-06T23:59:01.010339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.20111","last_updated":"2023-10-31T01:08:34Z","snapshot_observed_at":"2026-07-06T16:40:51.343918Z","submitted_at":"2023-10-31T01:08:34Z","title":"Making Large Language Models Better Data Creators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.20111","snapshot_observed_at":"2026-08-06T23:59:01.173754Z","title":"Making large language models better data creators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.173754Z"},"links":{"cited_paper":"/paper/2310.20111","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:e7977bfbf492a9d572296e73a00467bd676c6b9505684322a846b1a78d957321","observation_id":"c3ba1c5e-50b3-4d04-9b84-57ac7e9733d8","resolution":{"observed_at":"2026-08-06T23:59:01.173754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05679","last_updated":"2022-11-10T18:42:34Z","snapshot_observed_at":"2026-07-06T11:56:47.302637Z","submitted_at":"2021-10-12T01:45:27Z","title":"Large Language Models Can Be Strong Differentially Private Learners","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.05679","snapshot_observed_at":"2026-08-06T23:59:01.305802Z","title":"Large language models can be strong differentially private learners, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.305802Z"},"links":{"cited_paper":"/paper/2110.05679","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:01f3b78716056451fed92ee4d14cd5c7debe1bcf5bbf7b8e8ec800fcd682061b","observation_id":"71d640f6-0d1f-4b9b-ac11-125c19e8d0dc","resolution":{"observed_at":"2026-08-06T23:59:01.305802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.20110","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:05.807938Z","title":"Efficient model development through fine-tuning transfer, 2025","venue":null,"work_id":"ca0b9521-b3d1-46db-bd0b-64230209bc80","year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.452910Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:55b19e13039c77e3ea0d622b068b7bc0450e7a5144d0fac20c7a7948c674be65","observation_id":"4ef1e7fe-f22b-4232-b7c6-0365d4fbf836","resolution":{"observed_at":"2026-08-06T23:59:05.972463Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T23:59:01.628222Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.628222Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:fc743254cc659c5a068b9b7ab759d0804275c389c30fe041a8f6af293867d01b","observation_id":"f32a1e12-6f3f-4801-a977-3345b5a12a0a","resolution":{"observed_at":"2026-08-06T23:59:01.628222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00264","last_updated":"2024-03-30T06:40:54Z","snapshot_observed_at":"2026-08-04T05:46:31.894163Z","submitted_at":"2024-03-30T06:40:54Z","title":"DiLM: Distilling Dataset into Language Model for Text-level Dataset Distillation","version":1},"cited_work":{"arxiv_id":"2404.00264","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.00264","snapshot_observed_at":"2026-08-06T23:59:05.385249Z","title":"DiLM: Distilling Dataset into Language Model for Text-level Dataset Distillation","venue":"cs.CL","work_id":"554af822-a0e4-42c5-81fb-ef24f7955163","year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.783356Z"},"links":{"cited_paper":"/paper/2404.00264","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:574c992d22ffdabd8d3eaa66b6b9994254658cef952ae555a85c017fc61ea074","observation_id":"43d2f168-00cc-40c8-9e15-91fdfdb406be","resolution":{"observed_at":"2026-08-06T23:59:05.548663Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T23:59:01.963392Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:01.963392Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:84a4ccefd00126eae131560d3b302f97f5359c0758e186a019a8660bb45d1c3e","observation_id":"7d54b2b6-e4cc-4351-a1fe-ea6513ac22c0","resolution":{"observed_at":"2026-08-06T23:59:01.963392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:08.233001Z","title":"Coresets for robust training of deep neural networks against noisy labels","venue":null,"work_id":"ddb6b2c8-f84b-4ee5-aae0-d514b404e6eb","year":2020},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.139584Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:e70e876d8b6c80a2637c33eff0333bbec57ede7b8a965488afd0f0f7c96cfed4","observation_id":"cdc8614b-9460-4c68-8d0e-329cd8e5df60","resolution":{"observed_at":"2026-08-06T23:59:08.329164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:02.243562Z","title":"Twenty Newsgroups","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.243562Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:bef8367678c143261e5f8fe63e08a03b2af0e35a35c6f0d5ad9ac4a1c37765b4","observation_id":"a9259e47-3708-4978-90d2-250f46b8bc60","resolution":{"observed_at":"2026-08-06T23:59:02.243562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.13647","last_updated":"2023-11-22T19:04:04Z","snapshot_observed_at":"2026-07-06T16:51:19.405206Z","submitted_at":"2023-11-22T19:04:04Z","title":"Language Model Inversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.13647","snapshot_observed_at":"2026-08-06T23:59:02.503431Z","title":"Morris, Wenting Zhao, Justin T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.503431Z"},"links":{"cited_paper":"/paper/2311.13647","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:92036acebb5583e357f38aee3a9177f56e539999ca45f8dd92480a74b9e46e2d","observation_id":"67848785-9880-4729-8fba-e2a0548ab204","resolution":{"observed_at":"2026-08-06T23:59:02.503431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24832","last_updated":"2025-06-18T15:27:03Z","snapshot_observed_at":"2026-08-01T21:38:41.511664Z","submitted_at":"2025-05-30T17:34:03Z","title":"How much do language models memorize?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.24832","snapshot_observed_at":"2026-08-06T23:59:02.626543Z","title":"Morris, Chawin Sitawarin, Chuan Guo, Narine Kokhlikyan, G","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.626543Z"},"links":{"cited_paper":"/paper/2505.24832","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:3570c712de83ffd3a21b6f7a38ed5fb0958274c5e4248599c0e3b1a5d29685db","observation_id":"71335e31-71e3-47e8-84ca-71cfd9d979ce","resolution":{"observed_at":"2026-08-06T23:59:02.626543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17035","last_updated":"2023-11-28T18:47:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T18:47:03Z","title":"Scalable Extraction of Training Data from (Production) Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17035","snapshot_observed_at":"2026-08-06T23:59:02.760712Z","title":"Feder Cooper, Daphne Ippolito, Christopher A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.760712Z"},"links":{"cited_paper":"/paper/2311.17035","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:d6677c1ab57c098936ece09d0cf854198266df1335b7e26efbc1ddc22b865773","observation_id":"db648e96-6e9c-4040-be16-00146c2ae2b6","resolution":{"observed_at":"2026-08-06T23:59:02.760712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:02.910601Z","title":null,"venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:02.910601Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:b59a9574c94d2cc08672ea2feccae64b4d22fe50570322c3e64ab3f8c42bc52c","observation_id":"a8c24dff-b8b3-4395-900e-3ad2923ed06d","resolution":{"observed_at":"2026-08-06T23:59:02.910601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17607","last_updated":"2025-06-06T19:43:38Z","snapshot_observed_at":"2026-08-04T08:35:07.577161Z","submitted_at":"2025-02-24T19:49:15Z","title":"Synthetic Text Generation for Training Large Language Models via Gradient Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17607","snapshot_observed_at":"2026-08-06T23:59:03.031567Z","title":"Synthetic text generation for training large language models via gradient matching, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.031567Z"},"links":{"cited_paper":"/paper/2502.17607","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:d3fc0182cbf014642e263da9f077eec7450c2290b2ed1524b7277c54b70fffcf","observation_id":"5571f04f-54f5-4128-b128-4ada8f854d24","resolution":{"observed_at":"2026-08-06T23:59:03.031567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:03.164482Z","title":"Estimating training data influence by tracing gradient descent","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.164482Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:cb0fa6bba537090e9fca2e580f10d7caca1ac85a1ced1c1bd8186a9ae1fc2600","observation_id":"ac246015-d88c-4c48-8076-7b413a25751b","resolution":{"observed_at":"2026-08-06T23:59:03.164482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:03.264122Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.264122Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:ce23fa7c3c2921c0c54d0c8098b76faee388a0846a276dff9194a4d76bf3e85f","observation_id":"3039758f-80b8-490c-a8ae-8429c7f967d7","resolution":{"observed_at":"2026-08-06T23:59:03.264122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08544","last_updated":"2024-12-11T17:00:29Z","snapshot_observed_at":"2026-07-06T20:05:23.685854Z","submitted_at":"2024-12-11T17:00:29Z","title":"Training Data Reconstruction: Privacy due to Uncertainty?","version":1},"cited_work":{"arxiv_id":"2412.08544","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.08544","snapshot_observed_at":"2026-08-06T23:59:04.964213Z","title":"Training Data Reconstruction: Privacy due to Uncertainty?","venue":"cs.LG","work_id":"a1ad0f47-9194-44bf-b88c-75da8df5d430","year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.367720Z"},"links":{"cited_paper":"/paper/2412.08544","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:43adb87918ed811cbcb4f63053e1febe911b6b4a6ca73918963a30964db6f858","observation_id":"91d15c3e-f10f-48b4-86a5-48b4bec7eb0c","resolution":{"observed_at":"2026-08-06T23:59:05.085352Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.10959","last_updated":"2020-02-24T23:25:50Z","snapshot_observed_at":"2026-07-06T07:17:20.813296Z","submitted_at":"2018-11-27T13:17:45Z","title":"Dataset Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.10959","snapshot_observed_at":"2026-08-06T23:59:03.562990Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.562990Z"},"links":{"cited_paper":"/paper/1811.10959","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:984862c340c4c3df255fd98540d59e88bd3df0ccb5b3b5481cb01161b342df4d","observation_id":"75cc5f64-cb2f-4299-8a0e-067d162f76e8","resolution":{"observed_at":"2026-08-06T23:59:03.562990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-07-06T17:26:27.288834Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-06T23:59:03.711431Z","title":"Less: Selecting influential data for targeted instruction tuning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.711431Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:04cb07a8e3c906825dd174fdfb142ceee2bbfaaab185e6ab9aeb9bf374649f9d","observation_id":"86930eeb-2581-4feb-8996-c825a2b0a21e","resolution":{"observed_at":"2026-08-06T23:59:03.711431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:03.837866Z","title":"Data selection for language models via importance resampling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.837866Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:a6452627480b21a64d54346f4e47fac79ff5bd4a6da16b6626548613c40c3242","observation_id":"5a1c75ae-a5d5-4da6-9577-fd123feecb0a","resolution":{"observed_at":"2026-08-06T23:59:03.837866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16208","last_updated":"2025-04-07T18:16:42Z","snapshot_observed_at":"2026-07-06T19:37:16.203681Z","submitted_at":"2024-10-21T17:11:21Z","title":"Compute-Constrained Data Selection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16208","snapshot_observed_at":"2026-08-06T23:59:03.977103Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.977103Z"},"links":{"cited_paper":"/paper/2410.16208","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:22d5dbaff543f148f0b5a41a606c77bb317ab272fdc57964a29d2c9d319006cd","observation_id":"aecf3c81-523d-4fce-af6f-0980670db00f","resolution":{"observed_at":"2026-08-06T23:59:03.977103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13092","last_updated":"2024-02-11T20:34:51Z","snapshot_observed_at":"2026-07-06T15:45:39.649725Z","submitted_at":"2023-06-22T17:59:58Z","title":"Squeeze, Recover and Relabel: Dataset Condensation at ImageNet Scale From A New Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13092","snapshot_observed_at":"2026-08-06T23:59:04.118690Z","title":"Squeeze, recover and relabel: Dataset condensation at imagenet scale from a new perspective, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.118690Z"},"links":{"cited_paper":"/paper/2306.13092","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:6c0eab46fd2786b0227a7b8d9dccfede9697192ba056f2d0cc3b70646a9de147","observation_id":"a0944248-4c16-4dc6-8729-1a0cff764c0c","resolution":{"observed_at":"2026-08-06T23:59:04.118690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.01626","last_updated":"2016-04-04T02:34:30Z","snapshot_observed_at":"2026-08-07T08:03:58.370822Z","submitted_at":"2015-09-04T22:31:53Z","title":"Character-level Convolutional Networks for Text Classification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.01626","snapshot_observed_at":"2026-08-06T23:59:04.278430Z","title":"Character-level convolutional networks for text classification, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.278430Z"},"links":{"cited_paper":"/paper/1509.01626","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:b83b5a08973bc0011aaa2f85b34e33e458bf4b0245461591825a6686218055c2","observation_id":"3f63f595-2720-4c1e-a243-943ded2ecdff","resolution":{"observed_at":"2026-08-06T23:59:04.278430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.05929","last_updated":"2021-03-08T13:31:22Z","snapshot_observed_at":"2026-08-06T01:24:57.284854Z","submitted_at":"2020-06-10T16:30:52Z","title":"Dataset Condensation with Gradient Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.05929","snapshot_observed_at":"2026-08-06T23:59:04.416765Z","title":"Dataset condensation with gradient matching, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.416765Z"},"links":{"cited_paper":"/paper/2006.05929","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:0fb92779ea4c0a3d2b83ecbe9d9dbf21f95f9be019fdf4ee858b336bd008ace4","observation_id":"47ce09c5-d399-44c2-8303-d59882e02e31","resolution":{"observed_at":"2026-08-06T23:59:04.416765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:07.963591Z","title":"Dataset distillation using neural feature regression","venue":null,"work_id":"14578b69-ce1e-4262-b356-d8aa2dee98ba","year":2022},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.555823Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:8fc499679f96dd3ba0284e1205e805c302784b5784ee53a8f7d8cb9e14658966","observation_id":"3546edc5-6224-4098-a92a-d5a40d1de66c","resolution":{"observed_at":"2026-08-06T23:59:08.070508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:59:04.660958Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:04.660958Z"},"links":{"citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:52f71720349c02aeea248bc56dbf2141369b1c8137af7d9f92f02beca1d3e40e","observation_id":"20e572c3-a858-4cc0-86ba-c4522f835769","resolution":{"observed_at":"2026-08-06T23:59:04.660958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T23:51:02.952534Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":8,"verified_fuzzy":7},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2506.15553."}