{"as_of":"2026-08-08T05:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2f110f57bd4f0c216011065f09e484d3953e5e105104a2f504fbef5e1e82042","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:51:48.595357Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.00038/citation-record","integrity":"/paper/2507.00038/integrity","json":"/paper/2507.00038/citation-record.json","paper":"/paper/2507.00038"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.19614","last_updated":"2024-06-28T02:41:33Z","snapshot_observed_at":"2026-08-01T22:24:19.495181Z","submitted_at":"2024-06-28T02:41:33Z","title":"A Survey on Data Quality Dimensions and Tools for Machine Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19614","snapshot_observed_at":"2026-08-06T23:51:45.136135Z","title":"A Survey on Data Quality Dimensions and Tools for Machine Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.136135Z"},"links":{"cited_paper":"/paper/2406.19614","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:d19e6ac08f8c2f10b9937baee602fa1c23f340e536c015a57355445a89f3d056","observation_id":"f2e93db1-97ac-4af7-acbe-46dd8f7ee32a","resolution":{"observed_at":"2026-08-06T23:51:45.136135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-981-97-1320-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:49.414321Z","title":"In Proceedings of the SmartCom 2024, Pune, India, 12 –13 January 2024 ; Volume 1, SpringerLink","venue":null,"work_id":"e0119744-8854-470f-afee-f76f979b765d","year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.179148Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:9133f906254a094d938f4a0611a15988ab3dda60ff8b56e7419e740f4109bcf5","observation_id":"c6fcaede-ccc3-4c2d-8382-35b1341f8967","resolution":{"observed_at":"2026-08-06T23:51:49.493515Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1519","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:49.229720Z","title":"CrossWeigh: Training Named Entity Tagger from Imperfect Annotations","venue":null,"work_id":"f89aa291-0854-4b55-9589-0a4b1db95aba","year":2019},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.261102Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:b33ef752c479924680e207242d60744f79cfbe48576808e8a774d3d8e8ce94ce","observation_id":"90da6005-12a5-49d3-bde9-9d28cb06e536","resolution":{"observed_at":"2026-08-06T23:51:49.328115Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:45.348269Z","title":"Confident Learning: Estimating Uncertainty in Dataset Labels","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.348269Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:752dd677dc37059a5d832097f5f9b5c39f90d50d6ef9261a88f6617ad76df0cc","observation_id":"35ba8ea7-9372-4002-aa02-213c4824b287","resolution":{"observed_at":"2026-08-06T23:51:45.348269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:45.419712Z","title":"Learning From Noisy Labels With Deep Neural Networks: A Survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.419712Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:b23185e0b352ed0b3bd35b49be87d48882fa980e2ec679fbcc95692e9b947e8f","observation_id":"57fc65fd-1e6e-48f7-8696-6b4475a25ee6","resolution":{"observed_at":"2026-08-06T23:51:45.419712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:52.576682Z","title":"Data Quality Considerations for Big Data and Machine Learning: Going Beyond Data Clean- ing and Transformations","venue":null,"work_id":"7f59e86a-8032-4e4f-b2e9-481afc67192d","year":2017},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.512495Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:9de34298e2971301d0223c8a04a1ccb663c9d326122dd605cdbadc6a1c596b41","observation_id":"a72553e6-b8a9-4f6b-8997-552e3d2079bb","resolution":{"observed_at":"2026-08-06T23:51:52.657084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12267","last_updated":"2024-03-20T01:46:13Z","snapshot_observed_at":"2026-07-06T17:46:42.199436Z","submitted_at":"2024-03-18T21:32:58Z","title":"Data-Efficient Contrastive Language-Image Pretraining: Prioritizing Data Quality over Quantity","version":2},"cited_work":{"arxiv_id":"2403.12267","doi":"10.48550/arxiv.2403.12267","metadata_source":"pith","pith_arxiv_id":"2403.12267","snapshot_observed_at":"2026-08-07T06:16:28.064256Z","title":"Data-Efficient Contrastive Language-Image Pretraining: Prioritizing Data Quality over Quantity","venue":"cs.CV","work_id":"075c3762-3927-4411-b36a-674e41a61fc2","year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.583565Z"},"links":{"cited_paper":"/paper/2403.12267","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:d505b9b91cb0eb04d8cc4506e5799e5fdc713e0cff88af66eacffab8bd3e3ca2","observation_id":"7e00f20d-b86c-4c89-9e01-3217eb687411","resolution":{"observed_at":"2026-08-06T23:51:49.144334Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:45.661467Z","title":"A Data-Centric Approach to Improve Performance of Deep Learning Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.661467Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:956cdcab35c2ce19c6eb93c63a936026f8a44b63a6cd91bb1eb92f9bc5e68657","observation_id":"2177def0-63d6-4935-a979-f409263e4f24","resolution":{"observed_at":"2026-08-06T23:51:45.661467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:45.737130Z","title":"An In-Depth Analysis of Data Reduction Methods for Sustainable Deep Learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.737130Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:992482b5c9cff4cf49999d798af5e6b62228ec542201a6a686165d1e64afd75b","observation_id":"72cf5ff5-cd80-4702-a76e-0d7f3547426a","resolution":{"observed_at":"2026-08-06T23:51:45.737130Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.33225","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:50.509353Z","title":"A Comprehensive Survey of Dataset Distillation","venue":null,"work_id":"725854d2-3b2d-4335-8232-956d804bd84f","year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.804647Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:720be72eadfc075dafceda922c2917fca88edaffe1365a3aec32ea583d7845ec","observation_id":"ecee2159-2c65-46c2-9c07-4724d9012e07","resolution":{"observed_at":"2026-08-06T23:51:50.598589Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-06T23:51:45.880798Z","title":"Training Compute-Optimal Large Language Models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.880798Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:0b795271915356db6f4ff7d5fd4849ee939bafac9e806506f2a4b3915d339953","observation_id":"fb3a7525-7df1-40b0-ab72-773065a40ea6","resolution":{"observed_at":"2026-08-06T23:51:45.880798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01867","last_updated":"2024-01-03T18:19:51Z","snapshot_observed_at":"2026-08-04T10:53:35.171923Z","submitted_at":"2024-01-03T18:19:51Z","title":"Dataset Difficulty and the Role of Inductive Bias","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01867","snapshot_observed_at":"2026-08-06T23:51:45.953781Z","title":"Dataset Difficulty and the Role of Inductive Bias","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:45.953781Z"},"links":{"cited_paper":"/paper/2401.01867","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:000abd86dbe66ade6e0ee1abedf1c2478437cb79598e8861a3c3aa380941d888","observation_id":"c677b6a6-bc89-4cc8-99ea-5d2ddf41c7e4","resolution":{"observed_at":"2026-08-06T23:51:45.953781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:52.442054Z","title":"Deep Learning Through the Lens of Example Difficulty","venue":null,"work_id":"e9e739da-129c-4bba-93bd-1f22e85c5b5c","year":2021},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.044863Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:6f2547fc8e87ed7344e32ef045d7f4bdc6d45f159263b98550087c57655793c7","observation_id":"19446e99-cfe3-45bb-9759-6ca9551283a4","resolution":{"observed_at":"2026-08-06T23:51:52.498002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03058","last_updated":"2020-12-18T14:03:13Z","snapshot_observed_at":"2026-08-07T13:30:48.301129Z","submitted_at":"2020-10-06T22:02:46Z","title":"Characterising Bias in Compressed Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.03058","snapshot_observed_at":"2026-08-06T23:51:46.110585Z","title":"Characterising Bias in Compressed Models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.110585Z"},"links":{"cited_paper":"/paper/2010.03058","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:dda0c837c4a320091e914a5b4fc84a5ea4e9a79906523320b2108e3784a85f45","observation_id":"c009c363-0808-4771-9512-ac87d69d8ef0","resolution":{"observed_at":"2026-08-06T23:51:46.110585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:52.254220Z","title":"Learning Sample Difficulty from Pre-Trained Models for Reliable Prediction","venue":null,"work_id":"177378f8-1033-4a46-b162-d6811413131f","year":2023},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.185070Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:e6b9006526d7637b2de68988258467f83c4c7cbe1b945c2e96bbcfb6fd05c068","observation_id":"c6685146-bb1a-4b1d-869b-2143b53a65b5","resolution":{"observed_at":"2026-08-06T23:51:52.339745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:52.079024Z","title":"How Hard Are Computer Vision Datasets? Calibrating Dataset Difficulty to Viewing Time","venue":null,"work_id":"4fcf1541-648e-49a0-9850-88183adaba61","year":2023},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.261469Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:25bb926ae987789c6856a51ac6e96f9d2c1edb0fac14155bf05dc781ff9fc386","observation_id":"1a6964fe-2171-4e45-8a9e-7c4b6ec5c2d9","resolution":{"observed_at":"2026-08-06T23:51:52.158174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09272","last_updated":"2022-12-19T06:55:42Z","snapshot_observed_at":"2026-08-03T20:03:31.567079Z","submitted_at":"2022-12-19T06:55:42Z","title":"Statistical Dataset Evaluation: Reliability, Difficulty, and Validity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09272","snapshot_observed_at":"2026-08-06T23:51:46.334675Z","title":"Statistical Dataset Evaluation: Reliability, Difficulty, and Validity","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.334675Z"},"links":{"cited_paper":"/paper/2212.09272","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:1dd0b2e871c51964e86cc1be1ebd72dd3e27efde7ae189d183c545d732c3a305","observation_id":"5ff7869a-3a01-4ec5-97ce-41f3c772ca14","resolution":{"observed_at":"2026-08-06T23:51:46.334675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:51.933537Z","title":"Understanding Dataset Difficulty with V-Usable Information","venue":null,"work_id":"2a829b58-0a7a-4cf4-8917-6808d26e2178","year":2022},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.421115Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:314d16226d70eccedf181a204f3b66c0c69072bac3f2f97c2c1ec5b97863fe9e","observation_id":"8a87efaa-30d3-4b6f-8a80-c20fef5c48c3","resolution":{"observed_at":"2026-08-06T23:51:52.015805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:51.773571Z","title":"Surveying the Effects of Quality, Diversity, and Complexity in Synthetic Data From Large Language Models","venue":null,"work_id":"bd0590c9-1f8b-4252-b671-01836fa73035","year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.489059Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:106ff60067555175a7bbab1bc6901a6d786d1d9cf8a74c0ece2e4579bd1266d3","observation_id":"fe636bf9-d67f-421a-afcd-4ac0708b2e8d","resolution":{"observed_at":"2026-08-06T23:51:51.859648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:51.613261Z","title":"Do ImageNet Classifiers Generalize to ImageNet? In Proceedings of the 36th International Conference on Machine Learning, Long Beach, CA, USA , 24 May 2019; pp","venue":null,"work_id":"d2e3ae0e-91d5-43a0-9268-d4b768797eef","year":2019},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.543752Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:55c0813e5901484b88fc40faa8d5831e13c6a8a17389663b5f97aed653f33416","observation_id":"da96e2dd-ab68-4eae-92dd-b09b49815775","resolution":{"observed_at":"2026-08-06T23:51:51.665739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.07174","last_updated":"2021-03-04T21:56:19Z","snapshot_observed_at":"2026-07-06T08:08:08.790847Z","submitted_at":"2019-07-16T17:56:30Z","title":"Natural Adversarial Examples","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.07174","snapshot_observed_at":"2026-08-06T23:51:46.642010Z","title":"Natural Adversarial Examples","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.642010Z"},"links":{"cited_paper":"/paper/1907.07174","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:58ba4ae62e29f6d3406f56657d85da4ca976396ec0fb9b29b41176bc05c4d704","observation_id":"3ff5b469-8a84-4267-82aa-f8a14ff214ad","resolution":{"observed_at":"2026-08-06T23:51:46.642010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:51.484916Z","title":"The Third International Chinese Language Processing Bakeoff: Word Segmentation and Named Entity Recognition","venue":null,"work_id":"3b373adb-6752-440d-baa4-42b18820d6eb","year":2006},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.718672Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:2a8559dee3bbc6341ca4e8ab19b2f6a70405051a8e9a23d52b9a2ecbf3e48164","observation_id":"811f8a60-0040-49f3-a384-f1c47a0440ab","resolution":{"observed_at":"2026-08-06T23:51:51.551693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04351","last_updated":"2020-01-20T16:32:50Z","snapshot_observed_at":"2026-07-06T08:50:09.743009Z","submitted_at":"2020-01-13T15:39:56Z","title":"CLUENER2020: Fine-grained Named Entity Recognition Dataset and Benchmark for Chinese","version":4},"cited_work":{"arxiv_id":"2001.04351","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.04351","snapshot_observed_at":"2026-08-06T23:51:50.268869Z","title":"CLUENER2020: Fine-grained Named Entity Recognition Dataset and Benchmark for Chinese","venue":"cs.CL","work_id":"beafc731-eeec-43fe-a1bb-afbc5696f118","year":2020},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.780710Z"},"links":{"cited_paper":"/paper/2001.04351","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:036fa19dfc2bd18f078e08f796d11df2ac8af16fd6140bae330f437e37f7e814","observation_id":"19ad2287-a94b-4a33-9dad-93be97725d74","resolution":{"observed_at":"2026-08-06T23:51:50.335050Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:46.869091Z","title":"Natural Language Reasoning, A Survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.869091Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:5d6d2da9ef27e134750be0830832a3c99903b2eac6bc0596772f4da1514733c1","observation_id":"cf2c1402-4746-4b6c-9f6c-a721d0ce3b41","resolution":{"observed_at":"2026-08-06T23:51:46.869091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:51.303348Z","title":"A Theory of Usable Information Under Computational Constraints","venue":null,"work_id":"1d00f0d3-d15b-45a9-a9bb-aa9c373883f8","year":2025},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:46.954356Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:fe8619fe66cf5d120d913cac206423f26942756528baabb04511494e0a4a0ea5","observation_id":"daf0dd91-3ed0-405b-bc82-16d993b914c3","resolution":{"observed_at":"2026-08-06T23:51:51.359755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:47.030276Z","title":"A Mathematical Theory of Communication","venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.030276Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:5fb6de6222342bf906578f659643ed3ac9b7d7eac5fa2285f9df5f8d5dc23eba","observation_id":"76bf2cce-08ce-491f-9b11-546ba6665b8f","resolution":{"observed_at":"2026-08-06T23:51:47.030276Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.31243","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:49.976955Z","title":"Pre-Training With Whole Word Masking for Chinese BERT","venue":null,"work_id":"fb659977-49ca-4b38-b586-ac21c03f8f6d","year":2021},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.164222Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:7671b6b09b32bf48c903f0d873692c736d730a5d3eb0027e56bc4b54bf1b68fb","observation_id":"559e3d74-ee74-4edc-b5f4-6d1f67be088a","resolution":{"observed_at":"2026-08-06T23:51:50.050873Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:47.224432Z","title":"BERT: Pre-Training of Deep Bidirectional Transformers for Language Under- standing","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.224432Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:2159a0c05bc64467329737453d56af272a216a96b6a06f34efffe841f0b79102","observation_id":"d3c30675-5924-4cf3-8650-c33564400cb8","resolution":{"observed_at":"2026-08-06T23:51:47.224432Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:47.309635Z","title":"Revisiting Pre-Trained Models for Chinese Natural Language Processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.309635Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:a9a2ce9fae8318ca1d0762943a06720b538e421b7870a1a092463eb2206da549","observation_id":"bf1568ca-0fb7-4854-81e1-0d87f315364a","resolution":{"observed_at":"2026-08-06T23:51:47.309635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.neunet.2020.05.011","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:48.775556Z","title":"Progressive Learning: A Deep Learning Framework for Continual Learning","venue":null,"work_id":"a609a423-ee08-49b2-9b42-5c1a5be4917e","year":2020},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.429397Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:5ed024fc2ea1c10212a9e233515b9aed73036a6b2c9636fe7f237303ca01071b","observation_id":"6cf3f037-a399-41fe-89fa-91639ec8d105","resolution":{"observed_at":"2026-08-06T23:51:48.845759Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:51.099922Z","title":"Cross-Entropy Loss Functions: Theoretical Analysis and Applications","venue":null,"work_id":"f1514144-76a0-4c53-8e50-4fa86622b5e9","year":2023},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.521015Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:544babaab7a332bc7d733ad8528f5048ca4dfeedfcf8ad317a85a47b879708d6","observation_id":"2a7b473b-7fed-4532-9ca7-a188821aae0a","resolution":{"observed_at":"2026-08-06T23:51:51.220883Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:50.924970Z","title":"Understanding Transformers via N-Gram Statistics","venue":null,"work_id":"86737fb6-0d1d-4b11-aacd-4ac8a7c70430","year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.612284Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:c4293b0137ebc0b08aa6cc6973be5b16d1638830713462ad62d8ecdd9207d995","observation_id":"afc632e7-4270-46c0-ab09-7fa29fac9e20","resolution":{"observed_at":"2026-08-06T23:51:51.019605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T23:51:47.680094Z","title":"Qwen3 Technical Report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.680094Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:40dba58bd2b06c6fee8420ffb26cf7ed59bcece9c8af43d16b9d2dbc9c91313a","observation_id":"1db8e1aa-87d1-4c89-8a4a-ccdb660e5e10","resolution":{"observed_at":"2026-08-06T23:51:47.680094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.05444","last_updated":"2020-10-12T04:25:48Z","snapshot_observed_at":"2026-07-06T10:03:28.013826Z","submitted_at":"2020-10-12T04:25:48Z","title":"OCNLI: Original Chinese Natural Language Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.05444","snapshot_observed_at":"2026-08-06T23:51:47.743789Z","title":"OCNLI: Original Chinese Natural Language Inference","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.743789Z"},"links":{"cited_paper":"/paper/2010.05444","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:0a7d8f106207cc0a593c0b743b949a1f849354f4eb34e847c707cd51baecad3a","observation_id":"bf9b1575-5487-4078-a352-5e62f44c4466","resolution":{"observed_at":"2026-08-06T23:51:47.743789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:47.832711Z","title":"CLUE: A Chinese Language Understanding Evaluation Benchmark","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.832711Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:cf1389152ee6d79f8d07961f3f96c1195e4bfc28df2facd928df141f8b4911be","observation_id":"8942e541-557d-4d90-9cfe-e6f2418a111a","resolution":{"observed_at":"2026-08-06T23:51:47.832711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:47.930154Z","title":"XNLI: Evaluating Cross-Lingual Sentence Representations","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:47.930154Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:07839b321f3d3956a9d38eafa2464716b86d79d21bf333332ef8cb9411762875","observation_id":"d46183a9-a5a6-4ac2-9e49-30f9872aa9cc","resolution":{"observed_at":"2026-08-06T23:51:47.930154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.05426","last_updated":"2018-02-19T19:19:51Z","snapshot_observed_at":"2026-08-04T05:17:48.256162Z","submitted_at":"2017-04-18T17:10:13Z","title":"A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.05426","snapshot_observed_at":"2026-08-06T23:51:48.022352Z","title":"A Broad-Coverage Challenge Corpus for Sentence Understanding through Inference","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:48.022352Z"},"links":{"cited_paper":"/paper/1704.05426","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:b84651e0150c02ec052282c1ebf15446269e7d53d7c0a4225a8320e317eb6639","observation_id":"b025c9e1-ad43-409b-b2ae-cdf415915c3c","resolution":{"observed_at":"2026-08-06T23:51:48.022352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:48.098262Z","title":"Annotation Artifacts in Natural Language Inference Data","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:48.098262Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:b3608b0f01e0d7a71868757f07a39b2d5924eb1cfa652dff808b8b542d1d1933","observation_id":"2275752a-5baf-431a-886b-c8c880fe9361","resolution":{"observed_at":"2026-08-06T23:51:48.098262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0744.36636","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:49.710242Z","title":"Sexism Detection on a Data Diet","venue":null,"work_id":"9816e89e-eab6-47ad-b8f2-ba8378fce401","year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:48.190832Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:48125d2e9fa359237e5dd1e6b8e1a1e43f03f80a3bda6639001ff0b97b985a8e","observation_id":"43068e36-80db-4997-acc3-a327eccab3a2","resolution":{"observed_at":"2026-08-06T23:51:49.763617Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07075","last_updated":"2023-03-28T13:51:14Z","snapshot_observed_at":"2026-07-06T11:29:17.619495Z","submitted_at":"2021-07-15T02:12:20Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.07075","snapshot_observed_at":"2026-08-06T23:51:48.265454Z","title":"Deep Learning on a Data Diet: Finding Important Examples Early in Training","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:48.265454Z"},"links":{"cited_paper":"/paper/2107.07075","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:4e338ca7ad25d35cbfd099e94840892cd280223daabc397c9853cb58b636c835","observation_id":"d5572fed-d1d8-421f-afe8-bfba04f75597","resolution":{"observed_at":"2026-08-06T23:51:48.265454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2008.11600","last_updated":"2022-06-21T04:22:54Z","snapshot_observed_at":"2026-07-06T09:50:19.246383Z","submitted_at":"2020-08-26T14:53:24Z","title":"Estimating Example Difficulty Using Variance of Gradients","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2008.11600","snapshot_observed_at":"2026-08-06T23:51:48.328470Z","title":"Estimating Example Difficulty Using Variance of Gradients","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:48.328470Z"},"links":{"cited_paper":"/paper/2008.11600","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:b7b58221969df76e816ba851e3c511ec49ae3edcacedfd61729e67eac5132970","observation_id":"f5ac62da-1c7f-4189-b086-2b62004dac0e","resolution":{"observed_at":"2026-08-06T23:51:48.328470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:51:50.781659Z","title":"Estimating Training Data Influence by Tracing Gradient Descent","venue":null,"work_id":"fc956e91-e646-4248-9e8f-d054f3f53876","year":2020},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:48.430531Z"},"links":{"citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:3044ed16c0b36f913ee6d4bf41082134b5b86542019c57f11919e295a953116d","observation_id":"97300c77-3f24-4868-bbd1-4a672ffa0ed8","resolution":{"observed_at":"2026-08-06T23:51:50.854209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-06T23:51:48.521674Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:48.521674Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:c0d533a1c44583bc882235ddd2df7b01cf58ef1372b256ccd86cc32064415b47","observation_id":"695869ff-5e1b-4dde-8d48-9c869284d47c","resolution":{"observed_at":"2026-08-06T23:51:48.521674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-06T23:51:48.595357Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T23:51:48.595357Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2507.00038"},"observation_digest":"sha256:88a72b9a5192c873eb968d0a31ab193568342480cd9e85bfdc02ba33dc742539","observation_id":"b2cea8f0-b380-4304-84e9-9b08ee841a6f","resolution":{"observed_at":"2026-08-06T23:51:48.595357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.00038","last_updated":"2025-08-08T06:00:37Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T10:36:08.128551Z","submitted_at":"2025-06-19T06:59:19Z","title":"Quality over Quantity: An Effective Large-Scale Data Reduction Strategy Based on Pointwise V-Information"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":3,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":21,"verified_exact":5,"verified_fuzzy":12},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2507.00038."}