{"as_of":"2026-08-08T12:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f71db06e246e3e540070fc15d342580004f923f386051e0c10d0bc8f13ecaa7","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:51:48.265454Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T02:56:29.498177Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-08-06T23:51:48.265454Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:48.265454Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:4e338ca7ad25d35cbfd099e94840892cd280223daabc397c9853cb58b636c835","observation_id":"d5572fed-d1d8-421f-afe8-bfba04f75597","resolution":{"observed_at":"2026-08-06T23:51:48.265454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-08-05T19:04:53.951203Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.13653","last_updated":"2025-08-22T14:54:58Z","snapshot_observed_at":"2026-08-07T05:37:20.213295Z","submitted_at":"2025-08-19T09:03:39Z","title":"GRAFT: Gradient-Aware Fast MaxVol Technique for Dynamic Data Sampling","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T19:04:53.951203Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2508.13653"},"observation_digest":"sha256:1a53621bc88430f5013db6d48da299921829b01dedebc212a454ae1e9c9a4858","observation_id":"91c61dae-04be-4e7b-8bcf-15ce4ceec057","resolution":{"observed_at":"2026-08-05T19:04:53.951203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":"2107.07075","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-07-02T02:56:29.498177Z","title":"Jason Rennie","venue":null,"work_id":"4199d212-b6e9-4333-b729-72cd39c7b384","year":2021},"citing_paper":{"arxiv_id":"2509.20786","last_updated":"2026-05-13T15:28:04Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-25T06:13:25Z","title":"LiLAW: Lightweight Learnable Adaptive Weighting to Learn Sample Difficulty & Improve Noisy Training","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T15:01:49.645065Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2509.20786"},"observation_digest":"sha256:0b8044a70f38f322a087ae90755caba6b8d4f9d63b7bb8271ab293e3bee27f90","observation_id":"22619208-d700-4da3-9bbf-7fbac00d73cb","resolution":{"observed_at":"2026-05-18T15:02:41.223402Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-08-02T19:46:20.705950Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.01195","last_updated":"2026-06-25T08:08:57Z","snapshot_observed_at":"2026-08-07T03:33:50.802975Z","submitted_at":"2026-03-01T17:26:02Z","title":"VisNec: Measuring and Leveraging Visual Necessity for Multimodal Instruction Tuning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T19:46:20.705950Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2603.01195"},"observation_digest":"sha256:bb1c94798a79fe577de8dd70785a19934902097b6eb102c84acfafb2f273db83","observation_id":"b4de92bb-889d-4422-ac3f-a635ae3a8e05","resolution":{"observed_at":"2026-08-02T19:46:20.705950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-07-14T22:18:56.115559Z","title":"arXiv preprint arXiv:2107.07075 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.12478","last_updated":"2026-07-09T06:30:13Z","snapshot_observed_at":"2026-08-04T00:27:12.184147Z","submitted_at":"2026-03-12T21:54:50Z","title":"Less Data, Faster Convergence: Goal-Driven Data Optimization for Multimodal Instruction Tuning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-14T22:18:56.115559Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2603.12478"},"observation_digest":"sha256:7d8300e6fd344dfdaca12cae47422ea3b93ee69cd39731fcfeb2bd9378efc403","observation_id":"ed43de6f-c7a0-4be2-869a-85a72305a2e2","resolution":{"observed_at":"2026-07-14T22:18:56.115559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":"2107.07075","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-07-02T02:56:29.498177Z","title":"Jason Rennie","venue":null,"work_id":"4199d212-b6e9-4333-b729-72cd39c7b384","year":2021},"citing_paper":{"arxiv_id":"2605.02609","last_updated":"2026-05-15T17:20:55Z","snapshot_observed_at":"2026-08-02T11:38:00.584240Z","submitted_at":"2026-05-04T13:56:09Z","title":"Gradient-Discrepancy Acquisition for Pool-Based Active Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T18:45:42.032855Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2605.02609"},"observation_digest":"sha256:def613a493cabfa0c6a6a534da31d657092155dcfa95e9b15443a96360c7a495","observation_id":"9fded019-b5a9-4826-8349-26b1af9e9ed9","resolution":{"observed_at":"2026-05-09T06:15:37.314329Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":"2107.07075","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-07-02T02:56:29.498177Z","title":"Jason Rennie","venue":null,"work_id":"4199d212-b6e9-4333-b729-72cd39c7b384","year":2021},"citing_paper":{"arxiv_id":"2605.02609","last_updated":"2026-05-15T17:20:55Z","snapshot_observed_at":"2026-08-02T11:38:00.584240Z","submitted_at":"2026-05-04T13:56:09Z","title":"Gradient-Discrepancy Acquisition for Pool-Based Active Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T17:19:30.778377Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2605.02609"},"observation_digest":"sha256:e7d91249d716a0c0a7b32dccd7d924427194ad043d63f66b94a03efc7bbb02dd","observation_id":"7f109a3a-4575-41a0-9ada-0f5c9cdd58e3","resolution":{"observed_at":"2026-05-19T17:22:42.037579Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":"2107.07075","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-07-02T02:56:29.498177Z","title":"Jason Rennie","venue":null,"work_id":"4199d212-b6e9-4333-b729-72cd39c7b384","year":2021},"citing_paper":{"arxiv_id":"2605.26761","last_updated":"2026-06-04T11:25:43Z","snapshot_observed_at":"2026-08-07T07:39:24.974510Z","submitted_at":"2026-05-26T09:31:20Z","title":"Once-For-All: A Train-Once and Select-Anytime Framework for Multimodal Instruction Tuning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T18:32:53.558370Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2605.26761"},"observation_digest":"sha256:ebac16c89bda87b31db8299f4b73bcbc7f0bff7ce5da42cb204b0f63f82b0162","observation_id":"4a9de1ea-d4e7-4468-9f60-85013a181a9f","resolution":{"observed_at":"2026-06-29T18:33:50.138290Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":"2107.07075","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-07-02T02:56:29.498177Z","title":"Jason Rennie","venue":null,"work_id":"4199d212-b6e9-4333-b729-72cd39c7b384","year":2021},"citing_paper":{"arxiv_id":"2606.04212","last_updated":"2026-06-08T18:25:59Z","snapshot_observed_at":"2026-07-06T23:44:23.633099Z","submitted_at":"2026-06-02T20:58:40Z","title":"Edge of Stability Selectively Shapes Learning Across the Data Distribution","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T10:27:39.029895Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2606.04212"},"observation_digest":"sha256:78fc3ba9c220db55d62d89077bfacc0b37d0c57aa68f26def3145c7015f8c602","observation_id":"b571ffd5-6ef9-4e19-8889-8eadc72f92bb","resolution":{"observed_at":"2026-07-02T02:56:29.500557Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2107.07075/citation-record","integrity":"/paper/2107.07075/integrity","json":"/paper/2107.07075/citation-record.json","paper":"/paper/2107.07075"},"outbound":[],"paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2107.07075."}