{"as_of":"2026-08-07T08:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3c342a825ceb4569951fbc0968a13cb444a497ae42cd9649cbf99ce955bb413f","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T17:43:53.953535Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.10088/citation-record","integrity":"/paper/2507.10088/integrity","json":"/paper/2507.10088/citation-record.json","paper":"/paper/2507.10088"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.606270Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.606270Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:80f4a01dd3fb32ae7a05e862b338631efc25e9e68f6c26affed63679c7389dcd","observation_id":"b0783815-7040-43ce-84d0-98a2630c1f38","resolution":{"observed_at":"2026-08-06T17:43:53.606270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:59.203603Z","title":null,"venue":null,"work_id":"3c3abf1b-045a-4b46-b705-f0d379dd9b00","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.610871Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:bc1a17c79f6856cea24cb3d33d82b319ca7032e057732b6897e4fbfa0c095e5a","observation_id":"168dac2b-2fa5-4449-be73-4ff9058ebd40","resolution":{"observed_at":"2026-08-06T17:43:59.271855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:59.013237Z","title":null,"venue":null,"work_id":"a7e68afc-d357-40be-97be-83cd3351269f","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.615279Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b44bd7dd599a333c8546bc624275d654d58ebdda0a16d5fc825c75ae61b58237","observation_id":"b53cc0bd-a50e-49e7-80ae-129c34617ae4","resolution":{"observed_at":"2026-08-06T17:43:59.103440Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.619500Z","title":null,"venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.619500Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:837ecc79cd53fe8c5ce9d769e202511bfd52e223f809f658147a9ceb79f7ffd8","observation_id":"cec813aa-1da5-431f-9667-c983e9118e19","resolution":{"observed_at":"2026-08-06T17:43:53.619500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.802413Z","title":null,"venue":null,"work_id":"879dc863-4539-44d6-8b45-d145fe3f549c","year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.623978Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:44158afde29fb2aaaa8472c917f6b57ce8e0d8790f93108698068745ed46fe56","observation_id":"05d9d306-f318-4e95-96d0-44a9eb8ae090","resolution":{"observed_at":"2026-08-06T17:43:58.900335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03672","last_updated":"2024-07-04T06:37:09Z","snapshot_observed_at":"2026-08-07T04:02:17.654537Z","submitted_at":"2024-07-04T06:37:09Z","title":"A Survey of Data Synthesis Approaches","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03672","snapshot_observed_at":"2026-08-06T17:43:53.628734Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.628734Z"},"links":{"cited_paper":"/paper/2407.03672","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:8b13a392f42d693df5b5a71806748ff1e10306b0d76383f397afa5728486ab0a","observation_id":"886f478c-0d1b-48a0-bd7e-ce8efe4a749e","resolution":{"observed_at":"2026-08-06T17:43:53.628734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.633557Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.633557Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:d2e6f24fed773fe1931d8311ebc811c584df867b134f8a12455f4f9aa51bd591","observation_id":"b88bdf6c-d187-4653-87b8-671cf63cd02b","resolution":{"observed_at":"2026-08-06T17:43:53.633557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.637534Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.637534Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:e32d124629a7ef781bffde5f167f938f8dc791c26833fc8d7030c69fade33426","observation_id":"79a0c5f6-5563-4a56-bbd8-0a95636bf747","resolution":{"observed_at":"2026-08-06T17:43:53.637534Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08939","last_updated":"2024-05-28T04:32:09Z","snapshot_observed_at":"2026-08-06T03:42:39.770101Z","submitted_at":"2024-02-14T04:50:18Z","title":"Premise Order Matters in Reasoning with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08939","snapshot_observed_at":"2026-08-06T17:43:53.641538Z","title":"Chi, Xuezhi Wang, and Denny Zhou","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.641538Z"},"links":{"cited_paper":"/paper/2402.08939","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:9a32e5e827bda03ea83b7cb2a48904ccb035159666919fbed63fd1b10d97d8d4","observation_id":"e01b675f-e5df-4299-a665-2789d87dab78","resolution":{"observed_at":"2026-08-06T17:43:53.641538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8496.2019","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.335849Z","title":null,"venue":null,"work_id":"8e115140-cecb-4e9c-9766-29c0d1393a53","year":2019},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.645569Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:1acf18777d02ab39ec7b6e1303d6437219c9ba55e7d9bc687dd19cf90653d9c4","observation_id":"ded3651d-20a1-422d-b24d-6d27894bee78","resolution":{"observed_at":"2026-08-06T17:43:55.388061Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.660015Z","title":null,"venue":null,"work_id":"d232f656-a343-45e1-a57f-89cc36913c96","year":1988},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.649666Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:9030e8809993a9ff5fe387beda8029a834b94327cf402dc84b4b91c0ee86a1f9","observation_id":"5fee9f79-f6ce-4e19-b179-984e39fd003c","resolution":{"observed_at":"2026-08-06T17:43:58.733718Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.494512Z","title":null,"venue":null,"work_id":"89336ce4-e79b-44ec-9927-9241036bd397","year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.653485Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:a8e4eb69342f21da3814e4bafd64df758e60051e13e93bdb9c34cd1d73f73826","observation_id":"e50d687d-0282-49c6-b739-df56023b57f2","resolution":{"observed_at":"2026-08-06T17:43:58.550332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T17:43:53.657338Z","title":"Zhang, Han Bao, Hanwei Xu, Haocheng Wang, Haowei Zhang, Honghui Ding, Huajian Xin, Huazuo Gao, Hui Li, Hui Qu, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.657338Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:87779371462b24bf32c13b42fca4e3c35de742ae38e61cb2d422e3b2e4fa44ab","observation_id":"0152c6d9-dfab-4a31-a244-4a064924b5ad","resolution":{"observed_at":"2026-08-06T17:43:53.657338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.286917Z","title":null,"venue":null,"work_id":"3b1a51ed-39e7-4136-a941-1e8d3cf46ebd","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.661572Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b692c98435cb663c2fd48857407cfd1269fbd1f9599c709c10127d4ca4196bda","observation_id":"cda3bd22-10b3-4e5f-a242-d76bb89d2d50","resolution":{"observed_at":"2026-08-06T17:43:58.383761Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:58.123117Z","title":"Duda, Peter E","venue":null,"work_id":"2efe9b27-6ee9-45cb-a21d-588a34ebb639","year":2000},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.665537Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:a5b29e49ead9fa5465dc079ac74cbb6f02eea114168701e91c0e7676b5e62225","observation_id":"645f64a9-07ee-4bf2-a440-bc63ff82a877","resolution":{"observed_at":"2026-08-06T17:43:58.212649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.08528","last_updated":"2022-05-11T16:22:21Z","snapshot_observed_at":"2026-08-07T03:41:15.061178Z","submitted_at":"2022-01-21T03:37:39Z","title":"To SMOTE, or not to SMOTE?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.08528","snapshot_observed_at":"2026-08-06T17:43:53.669542Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.669542Z"},"links":{"cited_paper":"/paper/2201.08528","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:8e9d9fd769f936889fc7302c2f3c8636d16456527ff3cd93ee51266ea4a89294","observation_id":"085c05c8-4c51-411f-bca4-5b39bbc4ae2d","resolution":{"observed_at":"2026-08-06T17:43:53.669542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.673605Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.673605Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:a63a31f1ba95ea126e42d1cd74b1183fe669f0f2eb7031c03d4c7bbea26aa350","observation_id":"c6088632-2d38-4e5b-9f20-384c1e120ba2","resolution":{"observed_at":"2026-08-06T17:43:53.673605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.959498Z","title":null,"venue":null,"work_id":"357f2c09-777a-4283-aa54-b94d07605cf7","year":2019},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.682598Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:fb4912a837543fd1d2539c4cb99b17aaeaab4773162f9faa1320515fa0de4723","observation_id":"74a9857c-4781-489c-929f-010cebf8f2b2","resolution":{"observed_at":"2026-08-06T17:43:58.041526Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.805765Z","title":"Friedman","venue":null,"work_id":"2b276849-7ca8-4c57-b1bf-aeefb64f7254","year":2001},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.686915Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:3d0f8d0f0256705868ad9085937c587f6db632f82203c4752907894b06a60eb7","observation_id":"421ffdff-fa52-4ce2-9908-44d08743cd90","resolution":{"observed_at":"2026-08-06T17:43:57.885731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00770","last_updated":"2024-07-12T20:29:57Z","snapshot_observed_at":"2026-07-06T16:13:31.328402Z","submitted_at":"2023-09-02T00:32:55Z","title":"Bias and Fairness in Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00770","snapshot_observed_at":"2026-08-06T17:43:53.690982Z","title":"Gallegos, Ryan A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.690982Z"},"links":{"cited_paper":"/paper/2309.00770","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:d9bc78e7cc87303fe1e33c39bb2947924f2569b85f86b4962d7f44d798343c7a","observation_id":"4ecffbf0-0783-475e-a7c3-b963a9146042","resolution":{"observed_at":"2026-08-06T17:43:53.690982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10997","last_updated":"2024-03-27T09:16:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-18T07:47:33Z","title":"Retrieval-Augmented Generation for Large Language Models: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10997","snapshot_observed_at":"2026-08-06T17:43:53.695473Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.695473Z"},"links":{"cited_paper":"/paper/2312.10997","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:ba50b12fe39a2bf0a558641a9727d61df7fbdfecf4cc8e9e2a0a1a17bc5a6819","observation_id":"05509347-9b8e-4835-a7e2-838dc3c8be80","resolution":{"observed_at":"2026-08-06T17:43:53.695473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-04112-9_25","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.081783Z","title":null,"venue":null,"work_id":"0dce2a5e-6d97-4585-b93f-8215236a9fd5","year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.699732Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:dfda7ad63c6f34c2705bef9f2b40d18a7c0ffde8c578086167c6a0e7c2820be3","observation_id":"cf34e9bb-9fe8-49e7-9cff-532e8970f5a7","resolution":{"observed_at":"2026-08-06T17:43:54.086324Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04247","last_updated":"2017-03-13T04:55:19Z","snapshot_observed_at":"2026-07-06T05:33:25.278531Z","submitted_at":"2017-03-13T04:55:19Z","title":"DeepFM: A Factorization-Machine based Neural Network for CTR Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.04247","snapshot_observed_at":"2026-08-06T17:43:53.703634Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.703634Z"},"links":{"cited_paper":"/paper/1703.04247","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:1c7cf07d63ab1f82b7ea55da72955fae75e3e62880d353c074d86ca9501b82a5","observation_id":"43f8cee4-0ffd-417c-803b-897c165fb643","resolution":{"observed_at":"2026-08-06T17:43:53.703634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01172","last_updated":"2024-07-01T10:50:16Z","snapshot_observed_at":"2026-08-05T12:17:23.204989Z","submitted_at":"2024-07-01T10:50:16Z","title":"Enlarging of the sample to address multicollinearity","version":1},"cited_work":{"arxiv_id":"2407.01172","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.01172","snapshot_observed_at":"2026-08-06T17:43:55.121899Z","title":"Enlarging of the sample to address multicollinearity","venue":"stat.AP","work_id":"dc9d79a2-e64d-4245-91bf-0c90f6c93fc5","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.707741Z"},"links":{"cited_paper":"/paper/2407.01172","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:517515b069f743ed2adadfdf79e9deb3fa6eff4cc3102bcca8ed50ef6f61549f","observation_id":"c128d2fe-4b7c-45cc-b3de-04393f50bb08","resolution":{"observed_at":"2026-08-06T17:43:55.137466Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/iri.2018","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.065981Z","title":null,"venue":null,"work_id":"77282649-0d94-43d5-8695-ad4efd1b3a3a","year":2018},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.711947Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:afc467939450523277a17edb50546d7f8dc2b6d15465ae77cad7c313fc0d12a1","observation_id":"e1a29a07-aba8-4228-8f55-2cb9f93424cd","resolution":{"observed_at":"2026-08-06T17:43:54.070348Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03579","last_updated":"2022-06-08T14:01:43Z","snapshot_observed_at":"2026-08-07T05:10:41.239420Z","submitted_at":"2022-02-04T15:11:11Z","title":"Stop Oversampling for Class Imbalance Learning: A Critical Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03579","snapshot_observed_at":"2026-08-06T17:43:53.716115Z","title":"Hassanat, Ahmad S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.716115Z"},"links":{"cited_paper":"/paper/2202.03579","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:af29970d2faa6aba83744029f71e2bd7848e97b49aba8c601de5c6a7e97d4ea9","observation_id":"e4874d73-8834-4651-9fba-e1d760d4457e","resolution":{"observed_at":"2026-08-06T17:43:53.716115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.728372Z","title":"Tech Lab","venue":null,"work_id":"2ae1057d-5b77-469a-a854-11189a2d319e","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.720634Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:7b7b0449ccdfeadc13e328abc36cbd12f9aa45baaa84aef6a868f9f63262cb49","observation_id":"613a9f5d-6aec-4919-a29d-88ff3b1f8ae0","resolution":{"observed_at":"2026-08-06T17:43:57.747783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17216","last_updated":"2023-10-13T15:35:42Z","snapshot_observed_at":"2026-07-06T15:34:09.163519Z","submitted_at":"2023-05-26T19:22:03Z","title":"Generating Images with Multimodal Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17216","snapshot_observed_at":"2026-08-06T17:43:53.724609Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.724609Z"},"links":{"cited_paper":"/paper/2305.17216","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:64fe2ac218875be79db3d80a8fd7007feda548d832f52c7e124fe37320f9151e","observation_id":"bd6d1203-8287-4d1b-9e07-c236e12c21c2","resolution":{"observed_at":"2026-08-06T17:43:53.724609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15421","last_updated":"2024-10-07T12:38:57Z","snapshot_observed_at":"2026-07-06T13:58:14.551432Z","submitted_at":"2022-09-30T12:26:14Z","title":"TabDDPM: Modelling Tabular Data with Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15421","snapshot_observed_at":"2026-08-06T17:43:53.729012Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.729012Z"},"links":{"cited_paper":"/paper/2209.15421","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:40a99cfc2db491fb97188fecd4142609e46bdcac93f772b76784a359b1180456","observation_id":"a21e7800-5d77-4875-b749-55040d54b546","resolution":{"observed_at":"2026-08-06T17:43:53.729012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.591234Z","title":null,"venue":null,"work_id":"e523713a-55d5-472e-bca4-4047d5476726","year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.733730Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:de9ceff1948a94779521b5297b59e562b5f4b43270b501bdf166a2ccdc985199","observation_id":"28b2fda6-7eab-41e1-824c-f46faa389dcc","resolution":{"observed_at":"2026-08-06T17:43:57.647486Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00879","last_updated":"2024-10-31T13:02:55Z","snapshot_observed_at":"2026-07-06T19:43:46.557944Z","submitted_at":"2024-10-31T13:02:55Z","title":"DEREC-SIMPRO: unlock Language Model benefits to advance Synthesis in Data Clean Room","version":1},"cited_work":{"arxiv_id":"2411.00879","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.00879","snapshot_observed_at":"2026-08-06T17:43:55.025974Z","title":"DEREC-SIMPRO: unlock Language Model benefits to advance Synthesis in Data Clean Room","venue":"cs.DB","work_id":"158d9822-ae71-4671-b8ce-544f1b7cc014","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.737643Z"},"links":{"cited_paper":"/paper/2411.00879","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:68dc6f3b76194b09f7258fa229505fff3c4088c7b86e03881b83e095273c0b29","observation_id":"6f7d4a20-ff18-4a58-a247-caaea1aaf045","resolution":{"observed_at":"2026-08-06T17:43:55.040825Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.520478Z","title":null,"venue":null,"work_id":"333198d6-7db8-4b13-a17a-4a45ce2eca7f","year":2015},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.742392Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:5b774928725b61dd5bc6e4eb279cd4d5237d4aa43212a8437038510392cf88fb","observation_id":"3dc0f1e4-c225-4ed9-96ff-177784c51d07","resolution":{"observed_at":"2026-08-06T17:43:57.553852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02143","last_updated":"2024-01-04T08:49:10Z","snapshot_observed_at":"2026-08-05T00:02:08.028590Z","submitted_at":"2024-01-04T08:49:10Z","title":"Graph Neural Networks for Tabular Data Learning: A Survey with Taxonomy and Directions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02143","snapshot_observed_at":"2026-08-06T17:43:53.746389Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.746389Z"},"links":{"cited_paper":"/paper/2401.02143","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:bc8bfc501655f1b564c8a35e565d6b4fdb4179b68b5be939abba72a75a5102f4","observation_id":"f65df38c-2eb7-4157-b69c-04ef09460760","resolution":{"observed_at":"2026-08-06T17:43:53.746389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01432","last_updated":"2024-12-09T09:39:12Z","snapshot_observed_at":"2026-08-07T03:50:42.341073Z","submitted_at":"2023-09-29T14:38:58Z","title":"Split and Merge: Aligning Position Biases in LLM-based Evaluators","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01432","snapshot_observed_at":"2026-08-06T17:43:53.750706Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.750706Z"},"links":{"cited_paper":"/paper/2310.01432","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:d2605d9f69de72efb02bf6c50dcf4b39e3a6a239cf6ce118de35cb7cc76e7842","observation_id":"ca2eab54-2c32-44bf-8009-df4890752fe7","resolution":{"observed_at":"2026-08-06T17:43:53.750706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.425183Z","title":"McCallum and K","venue":null,"work_id":"b0f9682e-a35b-4ba5-bb4f-d4a6e72b0342","year":1998},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.754958Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:ba51e4a9d1a8248ad3ebf99067213138a4ab59607357851218f022c0bc6d463a","observation_id":"9ee7e4b8-7745-4c55-87be-dba90199ae87","resolution":{"observed_at":"2026-08-06T17:43:57.461141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.298767Z","title":null,"venue":null,"work_id":"aa434649-c312-4203-b4d0-4807ac3377e7","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.759096Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:1d59da727c389944ecbacdf791f3e7c49456656e787c39e573672b004918ef59","observation_id":"3cb394c7-f3ce-4fb8-bbfc-94a27a87c96a","resolution":{"observed_at":"2026-08-06T17:43:57.383359Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:57.047316Z","title":null,"venue":null,"work_id":"4b763b4e-719b-40f7-b8ec-17e424e5437e","year":2005},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.763110Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:8d175ba333a5bc34ad052a8699b35eee1f8813ef308e295b6bd552fc7fce9d4a","observation_id":"18d9950e-8767-4e1b-8655-f616c932aa99","resolution":{"observed_at":"2026-08-06T17:43:57.126646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.766886Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.766886Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:1015fd4d35422eaf0c8bf5f1432904e41f5eceb210ca3637fb2c7a52efea3b69","observation_id":"ab6a7e5e-d199-4021-a39c-088abe62ab77","resolution":{"observed_at":"2026-08-06T17:43:53.766886Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.879949Z","title":null,"venue":null,"work_id":"7fe3e9c7-7ed1-4596-9796-58750213cd19","year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.771570Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:2d96ae0988134ec314d706ba7f44693d50cdd8839a0d4a9375a477a991dd6fbf","observation_id":"e3c47cb8-ecc2-453c-9d23-02fdceec63e3","resolution":{"observed_at":"2026-08-06T17:43:56.954294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.654558Z","title":null,"venue":null,"work_id":"a434b939-ac3e-4cfc-8f23-30fa1010039c","year":2010},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.781350Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:94b792991d57ec5c86eef57ef83c875537beb837bace81e5b825b48c2a98d1b4","observation_id":"014a77b0-e9d2-433b-9b65-1f21b59c8c09","resolution":{"observed_at":"2026-08-06T17:43:56.758679Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21717","last_updated":"2024-10-29T04:14:32Z","snapshot_observed_at":"2026-07-06T19:41:15.267950Z","submitted_at":"2024-10-29T04:14:32Z","title":"Generating Realistic Tabular Data with Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.21717","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.21717","snapshot_observed_at":"2026-08-06T17:43:54.900862Z","title":"Generating Realistic Tabular Data with Large Language Models","venue":"cs.LG","work_id":"e0e6e106-ebe4-40fa-9d7e-043a37ae19dd","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.776191Z"},"links":{"cited_paper":"/paper/2410.21717","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:eaea0591bbf0f807be35b17d61e821ea79976d04da91923a6a9783059321753c","observation_id":"411cf88c-91f2-4b78-bae0-ea74c6dfa550","resolution":{"observed_at":"2026-08-06T17:43:54.905399Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09196","last_updated":"2025-06-12T07:17:19Z","snapshot_observed_at":"2026-08-07T05:22:02.357608Z","submitted_at":"2023-12-14T18:18:34Z","title":"Improved Algorithm for Deep Active Learning under Imbalance via Optimal Separation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09196","snapshot_observed_at":"2026-08-06T17:43:53.790544Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.790544Z"},"links":{"cited_paper":"/paper/2312.09196","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:e60010c10d1720c8e3f4bbf51833c338ab8bc2688c6de1da768cf456ce74e41f","observation_id":"dbf7bf68-6215-43ff-958a-3430cb4ec809","resolution":{"observed_at":"2026-08-06T17:43:53.790544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.00068","last_updated":"2022-08-22T00:58:03Z","snapshot_observed_at":"2026-07-06T08:33:56.199723Z","submitted_at":"2019-10-31T19:26:33Z","title":"Confident Learning: Estimating Uncertainty in Dataset Labels","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.00068","snapshot_observed_at":"2026-08-06T17:43:53.786241Z","title":"Northcutt, Lu Jiang, and Isaac L","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.786241Z"},"links":{"cited_paper":"/paper/1911.00068","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b8d2570a7939e32d84e04e2452c2de11446b81257223e24e4c15cb0359e700a1","observation_id":"e008506c-986c-45fe-95a1-b9a1fe5fa804","resolution":{"observed_at":"2026-08-06T17:43:53.786241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01703","last_updated":"2019-12-03T22:06:05Z","snapshot_observed_at":"2026-07-06T08:41:49.632205Z","submitted_at":"2019-12-03T22:06:05Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01703","snapshot_observed_at":"2026-08-06T17:43:53.799537Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.799537Z"},"links":{"cited_paper":"/paper/1912.01703","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:725c9c3a796581bb5f7337cf0ab02d756adaa2acc77d75dcf93b1b43b329d9d9","observation_id":"d6fc0c38-8670-45b4-90a3-b283df5ff2c1","resolution":{"observed_at":"2026-08-06T17:43:53.799537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.453856Z","title":null,"venue":null,"work_id":"15677d3d-1eb4-4a36-a69c-03643e09adaa","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.795073Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:4cd2ae148f75821da2071f661cc28a625a1c9f66ed86353a1d0e1c411a8ba270","observation_id":"07568641-6e2f-4ac2-b2ca-9676d338dc2f","resolution":{"observed_at":"2026-08-06T17:43:56.556448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.808261Z","title":"Pedregosa, G","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.808261Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:d77d4f3c55e8aee3069cab86e4b64b288c2722d8d4a41b46803d3afca19a3196","observation_id":"c32aa3ed-6ca1-43ca-9554-14e3903c7673","resolution":{"observed_at":"2026-08-06T17:43:53.808261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.803815Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.803815Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:2df3b24c955183363232fd96e74c8349407ce12a0196e5d4e2b7a40549e45b8d","observation_id":"3bb33d70-226d-4c7d-9a66-c83e164914ee","resolution":{"observed_at":"2026-08-06T17:43:53.803815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/00220670209598786","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.040139Z","title":null,"venue":null,"work_id":"7ddab018-abf9-4ec3-883f-4207d67d2356","year":2002},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.816144Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:d535af4c85a1d2e2ad4f941e06d429232b9b94ca51d2f58c9943896b8c08329e","observation_id":"8794fcdd-2312-4195-83ab-668c9e630df2","resolution":{"observed_at":"2026-08-06T17:43:54.044649Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00422","last_updated":"2025-03-20T10:08:31Z","snapshot_observed_at":"2026-08-02T20:41:02.005027Z","submitted_at":"2023-12-31T08:22:51Z","title":"Interpreting the Curse of Dimensionality from Distance Concentration and Manifold Effect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00422","snapshot_observed_at":"2026-08-06T17:43:53.812126Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.812126Z"},"links":{"cited_paper":"/paper/2401.00422","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:709e58ef33ea6f5e384ce6a4f323d54ad9c867932de79dc90ca0faf66d712e41","observation_id":"0c2313cc-4f78-47ae-8242-033606cfcdae","resolution":{"observed_at":"2026-08-06T17:43:53.812126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2021.67993","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.815478Z","title":null,"venue":null,"work_id":"eafd835a-14a2-4613-a19e-7c3f9ce240a6","year":2021},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.824532Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:f0858b90095c660277769fce700a45d1bb3f1972cebade159ac166a911de1719","observation_id":"9c60274a-ecb6-4778-8a97-da33673a260e","resolution":{"observed_at":"2026-08-06T17:43:54.822234Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.820503Z","title":"Pezoulas, Dimitrios I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.820503Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:2685f7b08f3fecb14ee5c123ef4a5884deae0839b9f9c08072cbc240180c53f6","observation_id":"8b3997fa-4740-4c6a-b175-abeb1e9a5cfb","resolution":{"observed_at":"2026-08-06T17:43:53.820503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-024-72894-y","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.013074Z","title":"Janes, Neal Navani, and Mihaela van der Schaar","venue":null,"work_id":"a86725eb-fbbd-4bbb-a071-46213933ac5c","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.834502Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:81fd61c7e5aaae5c8fe9ba9fbe3957f5e9736724126cf100bd91824206f64277","observation_id":"1c59db17-9c7a-439a-b5d2-190d8a59c887","resolution":{"observed_at":"2026-08-06T17:43:54.020040Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.11991","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.729601Z","title":null,"venue":null,"work_id":"0de7e3dc-ac25-43e9-982d-bce43d58376d","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.829369Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:bd813a89df0eae2b6b1cf273adcaebb213289ec1baae6c088faf337be96c2788","observation_id":"b18410dc-6d7d-4aad-8905-b5015a7c8bd9","resolution":{"observed_at":"2026-08-06T17:43:54.736218Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.100018Z","title":null,"venue":null,"work_id":"c8153167-857b-48b7-b597-4bbdf5bda387","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.845618Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b499b48c200da8f404d07447869d4fd12aca01bb7089ab2db31c2cbc6dff6093","observation_id":"2e169a37-301c-4565-b344-06c126440048","resolution":{"observed_at":"2026-08-06T17:43:56.152803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:56.273071Z","title":null,"venue":null,"work_id":"96ff9b9b-d0eb-4061-9b30-493b1efea222","year":1986},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.839921Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:d683ff72255f4f74002a18ff075372f397de282e5620f66adb28cd2d69e67e32","observation_id":"76f7be25-6ac7-4da3-8a78-ee1e70c2b2b5","resolution":{"observed_at":"2026-08-06T17:43:56.351969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.854928Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.854928Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:67db8d0e2a632ed16c6a7ee36ec4ba6c74a85a9511ce301361ed70c6794931c8","observation_id":"0242dc05-d6f6-45e7-a79d-1a5593684e44","resolution":{"observed_at":"2026-08-06T17:43:53.854928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.850809Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.850809Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:bdf4d7a9f6caad96a27a41ed51a5c09af7ed2bb60e5259a5873fea8e65955633","observation_id":"b134a428-7c58-4881-9413-7b2efed154a1","resolution":{"observed_at":"2026-08-06T17:43:53.850809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.868168Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.868168Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:81b39ba5ee99398aa151538507d3af224c81ff11033bc2d5657e1c8c533b1fb3","observation_id":"83e19de0-5620-4ac2-b558-8606e194b77e","resolution":{"observed_at":"2026-08-06T17:43:53.868168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11029","last_updated":"2024-05-17T18:03:59Z","snapshot_observed_at":"2026-07-06T18:15:58.951309Z","submitted_at":"2024-05-17T18:03:59Z","title":"Generative Artificial Intelligence: A Systematic Review and Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.11029","snapshot_observed_at":"2026-08-06T17:43:53.859410Z","title":"arXiv:2405.11029 [cs.LG] https://arxiv.org/abs/2405.11029","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.859410Z"},"links":{"cited_paper":"/paper/2405.11029","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:a7ae3e1a849e5239ebbd46b82b8bad12bfe967d8c3806c04ea8e5ed25f7bad78","observation_id":"a486d356-0992-46c6-97de-f8dc77c10bbe","resolution":{"observed_at":"2026-08-06T17:43:53.859410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1404.1100","last_updated":"2014-04-03T21:16:49Z","snapshot_observed_at":"2026-07-06T03:40:19.607628Z","submitted_at":"2014-04-03T21:16:49Z","title":"A Tutorial on Principal Component Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1404.1100","snapshot_observed_at":"2026-08-06T17:43:53.864011Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.864011Z"},"links":{"cited_paper":"/paper/1404.1100","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:4a414947a3b89a13616bcd24ba2d4b48bf22263afc6d937e1459f4e8df7def40","observation_id":"1bdbe017-a8bb-44e9-a194-e657cad487c5","resolution":{"observed_at":"2026-08-06T17:43:53.864011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.02966","last_updated":"2023-08-05T23:08:08Z","snapshot_observed_at":"2026-07-06T16:02:58.725804Z","submitted_at":"2023-08-05T23:08:08Z","title":"Generalized Oversampling for Learning from Imbalanced datasets and Associated Theory","version":1},"cited_work":{"arxiv_id":"2308.02966","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.02966","snapshot_observed_at":"2026-08-06T17:43:54.504316Z","title":"Generalized Oversampling for Learning from Imbalanced datasets and Associated Theory","venue":"stat.ML","work_id":"fc3b4681-b185-46ef-ac78-b725777f73e2","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.880251Z"},"links":{"cited_paper":"/paper/2308.02966","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:331d6bb6ee8b89a9615565eb655c5fe98e0f4984c9c23d6769ec0b8a755a0688","observation_id":"dcbfb885-ac9d-4ad4-9b46-234c98066168","resolution":{"observed_at":"2026-08-06T17:43:54.509696Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2017.82298","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.592321Z","title":null,"venue":null,"work_id":"e2cbc27a-b9ce-47b1-9aa8-109f12890afd","year":2017},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.872136Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:69cb624f6557354720e59ab8728523e901455abaf9e0633639fd1284f387ac5c","observation_id":"3e22f2d5-d5ce-450d-bfca-bd0b13f0cbff","resolution":{"observed_at":"2026-08-06T17:43:54.600360Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02041","last_updated":"2023-02-04T00:32:50Z","snapshot_observed_at":"2026-08-04T15:44:49.370490Z","submitted_at":"2023-02-04T00:32:50Z","title":"REaLTabFormer: Generating Realistic Relational and Tabular Data using Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02041","snapshot_observed_at":"2026-08-06T17:43:53.876143Z","title":"Solatorio and Olivier Dupriez","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.876143Z"},"links":{"cited_paper":"/paper/2302.02041","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:c3f20e863e5e6a13936d26f7e704caca40d032ac1b4eca98def06e41e3274cf8","observation_id":"aaa13ae3-bc3f-48d4-8204-25c1169af31c","resolution":{"observed_at":"2026-08-06T17:43:53.876143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02184","last_updated":"2024-10-03T03:58:03Z","snapshot_observed_at":"2026-07-06T19:26:43.399756Z","submitted_at":"2024-10-03T03:58:03Z","title":"CodeJudge: Evaluating Code Generation with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02184","snapshot_observed_at":"2026-08-06T17:43:53.893783Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.893783Z"},"links":{"cited_paper":"/paper/2410.02184","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b810ab9dedbadf904a2a3b4f4008f90bc00a7145aef3f0df2529329c1ec376aa","observation_id":"a5684bfc-50b1-436c-bc04-6f42c4ab0d8b","resolution":{"observed_at":"2026-08-06T17:43:53.893783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02059","last_updated":"2024-11-07T03:32:44Z","snapshot_observed_at":"2026-07-06T19:44:47.582139Z","submitted_at":"2024-11-04T13:03:13Z","title":"TableGPT2: A Large Multimodal Model with Tabular Data Integration","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02059","snapshot_observed_at":"2026-08-06T17:43:53.884678Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.884678Z"},"links":{"cited_paper":"/paper/2411.02059","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:cf4cc253326c5ca5c91589a9f2fd6d19c4148604a67a9ca31b14906bf3fd15c9","observation_id":"139d1d4c-88a9-4e1f-a35b-d09d3e809837","resolution":{"observed_at":"2026-08-06T17:43:53.884678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6176.48641","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.462354Z","title":null,"venue":null,"work_id":"2b5cfa60-6e26-4a63-bb8f-f7d8491afc84","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.889095Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:7459dc57a8a76250f3b445fad08d33f6da75132dbbef7d4282884ca5e84cf691","observation_id":"e5909a11-93ef-46e2-97eb-d57122d8de7b","resolution":{"observed_at":"2026-08-06T17:43:54.469270Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.739545Z","title":"Wei and Y","venue":null,"work_id":"fbe40ffe-6167-4c36-b1b5-2abb761d2094","year":2005},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.906516Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:5db59e520e31793058ef7fe5a774149d3207fc3311d1a9c1a6569eef174a5984","observation_id":"4fb87af6-3362-469a-8ca6-d33328f43267","resolution":{"observed_at":"2026-08-06T17:43:55.802661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.870306Z","title":null,"venue":null,"work_id":"4d8e57aa-d5ad-44de-8717-1333be6729a5","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.898594Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:7e6d28f21b82eaf0b16e686f067c02f08a8cd8120e1257ccc929281903cad364","observation_id":"e277fcb9-8892-4e24-9da5-47cb2ef61897","resolution":{"observed_at":"2026-08-06T17:43:55.995568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05579","last_updated":"2025-02-09T19:31:31Z","snapshot_observed_at":"2026-07-06T17:57:14.899058Z","submitted_at":"2024-04-08T14:55:35Z","title":"DRoP: Distributionally Robust Data Pruning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05579","snapshot_observed_at":"2026-08-06T17:43:53.902621Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.902621Z"},"links":{"cited_paper":"/paper/2404.05579","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:587edca40eba511138e3f3a96831d6f3756cadbfb77ba161c3ce02f30c4b3f6e","observation_id":"a1cc5830-96e8-4fa8-aff5-235904dd7ad0","resolution":{"observed_at":"2026-08-06T17:43:53.902621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18144","last_updated":"2024-04-28T11:27:30Z","snapshot_observed_at":"2026-07-06T18:06:40.922189Z","submitted_at":"2024-04-28T11:27:30Z","title":"Generative AI for Visualization: State of the Art and Future Directions","version":1},"cited_work":{"arxiv_id":"2404.18144","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.18144","snapshot_observed_at":"2026-08-06T17:43:54.337204Z","title":"Generative AI for Visualization: State of the Art and Future Directions","venue":"cs.LG","work_id":"37cd48e1-ac9f-4375-bd1e-e1fa5ce3e410","year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.923081Z"},"links":{"cited_paper":"/paper/2404.18144","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:cf2e012519be13249c76a2955d434707bd84974ccbe57b152cc825d7de80cd1d","observation_id":"76ca7cf0-edb7-463f-a934-fe273e9af2cb","resolution":{"observed_at":"2026-08-06T17:43:54.342597Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:53.910285Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.910285Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:c4cda845f45a829188294561a304e05fc74db4b6d92204787700e0a9f015669c","observation_id":"6d43bf99-76a4-40b0-b52a-bae9dce2ec4b","resolution":{"observed_at":"2026-08-06T17:43:53.910285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02536","last_updated":"2025-05-23T10:01:57Z","snapshot_observed_at":"2026-08-06T08:12:55.523935Z","submitted_at":"2024-06-04T17:55:38Z","title":"Mitigate Position Bias in Large Language Models via Scaling a Single Dimension","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02536","snapshot_observed_at":"2026-08-06T17:43:53.931934Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.931934Z"},"links":{"cited_paper":"/paper/2406.02536","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:6927b60ec393e017832f5901eb3ed8a7f01d5f9f27d58bcbe78136402c7bf8b3","observation_id":"4373a058-2648-4b5f-bd9a-a15bda9c8587","resolution":{"observed_at":"2026-08-06T17:43:53.931934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10015","last_updated":"2025-04-03T00:24:10Z","snapshot_observed_at":"2026-08-04T01:38:31.634090Z","submitted_at":"2023-05-17T07:49:16Z","title":"Utility Theory of Synthetic Data Generation","version":4},"cited_work":{"arxiv_id":"2305.10015","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.10015","snapshot_observed_at":"2026-08-06T17:43:54.358545Z","title":"Utility Theory of Synthetic Data Generation","venue":"stat.ML","work_id":"53f96505-68da-411e-9c91-37145ace8779","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.918674Z"},"links":{"cited_paper":"/paper/2305.10015","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:573b0ddb2a0cc5376d5dd66225212782b07534e37a7ec19cd98a425b04153545","observation_id":"ed000c46-ba34-4686-a0c0-5f63b2ebd20d","resolution":{"observed_at":"2026-08-06T17:43:54.363201Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.563776Z","title":null,"venue":null,"work_id":"ad791fba-b7c7-4c07-a3dc-5d4051410da1","year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.940669Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:2e0d791a30dc813969386d720da4505fd92f67a37f535ce783d01515af50d0d9","observation_id":"bde681a4-b5be-44f0-9dbd-bfadf10e6054","resolution":{"observed_at":"2026-08-06T17:43:55.622737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.00994","last_updated":"2024-04-25T09:53:33Z","snapshot_observed_at":"2026-07-06T16:01:34.200801Z","submitted_at":"2023-08-02T07:59:25Z","title":"SYNAuG: Exploiting Synthetic Data for Data Imbalance Problems","version":3},"cited_work":{"arxiv_id":"2308.00994","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.00994","snapshot_observed_at":"2026-08-06T17:43:54.316314Z","title":"SYNAuG: Exploiting Synthetic Data for Data Imbalance Problems","venue":"cs.CV","work_id":"f4b864d1-b9a2-4c5d-80dd-3633e59cb226","year":2023},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.927522Z"},"links":{"cited_paper":"/paper/2308.00994","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:fd27a445afb2bee07cfb8c7ca81069d5c9f357101b2c90466d79bc9f25af1d62","observation_id":"f59b6978-a3fd-492d-b398-44301ed4d42d","resolution":{"observed_at":"2026-08-06T17:43:54.321500Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2010.56093","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:54.215214Z","title":null,"venue":null,"work_id":"48cce14a-09b1-449a-8ea1-26e0ff6ca13e","year":2010},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.953535Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b4509a5848744952c1b4c011cee0397ad2d377802ddffa561d40ad3a8b5650ff","observation_id":"452cfb36-1343-4e87-8c4c-b417cad5023b","resolution":{"observed_at":"2026-08-06T17:43:54.222225Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10402","last_updated":"2024-03-20T12:52:10Z","snapshot_observed_at":"2026-07-06T16:33:47.711411Z","submitted_at":"2023-10-16T13:45:26Z","title":"Real-Fake: Effective Training Data Synthesis Through Distribution Matching","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10402","snapshot_observed_at":"2026-08-06T17:43:53.936245Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.936245Z"},"links":{"cited_paper":"/paper/2310.10402","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:e67134d5d17336de42582d3ac2dc55488dc7ff31a844eb9e7202591681fb2b3d","observation_id":"738c7bb7-e772-4878-92cf-dc45196505f2","resolution":{"observed_at":"2026-08-06T17:43:53.936245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02616","last_updated":"2019-04-04T15:42:58Z","snapshot_observed_at":"2026-08-03T22:31:56.711220Z","submitted_at":"2019-04-04T15:42:58Z","title":"Signal-to-Noise Ratio: A Robust Distance Metric for Deep Metric Learning","version":1},"cited_work":{"arxiv_id":"1904.02616","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.02616","snapshot_observed_at":"2026-08-06T17:43:54.262011Z","title":"Signal-to-Noise Ratio: A Robust Distance Metric for Deep Metric Learning","venue":"cs.CV","work_id":"8a80f87d-c7da-480e-91c7-0a6c027894db","year":2019},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.945202Z"},"links":{"cited_paper":"/paper/1904.02616","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:445ab1c30ab490229d87eb6682334ec67e9d288a0bbdfe87a2ef17089617e6b2","observation_id":"510a3c05-37d0-49dc-b0cf-0cdcf6a33239","resolution":{"observed_at":"2026-08-06T17:43:54.266799Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08855","last_updated":"2020-01-24T01:06:25Z","snapshot_observed_at":"2026-07-06T08:52:29.410955Z","submitted_at":"2020-01-24T01:06:25Z","title":"Privacy for All: Demystify Vulnerability Disparity of Differential Privacy against Membership Inference Attack","version":1},"cited_work":{"arxiv_id":"2001.08855","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.08855","snapshot_observed_at":"2026-08-06T17:43:54.238807Z","title":"Privacy for All: Demystify Vulnerability Disparity of Differential Privacy against Membership Inference Attack","venue":"cs.CR","work_id":"630402ba-b716-4ef7-b1a1-28082f15abb5","year":2020},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.949279Z"},"links":{"cited_paper":"/paper/2001.08855","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:a9bf85baabd6668e62f364be6a17c37f48977a76a9144142c4ed6d167f3e7ead","observation_id":"106a55de-89fe-49b0-b58c-4b1155a9faad","resolution":{"observed_at":"2026-08-06T17:43:54.243952Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T17:43:55.687892Z","title":"In Advances in Neural Information Processing Systems","venue":null,"work_id":"91d6cf12-0f69-43e8-80bb-303244fe0940","year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.914562Z"},"links":{"citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:b8a371c89719f6592b1401223b65b3b50ac3268089e6759ecd5ca93ad1eea9b2","observation_id":"405cb323-0713-407b-a698-ea8ba4556136","resolution":{"observed_at":"2026-08-06T17:43:55.702546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17944","last_updated":"2024-06-21T19:59:54Z","snapshot_observed_at":"2026-07-06T17:36:32.068270Z","submitted_at":"2024-02-27T23:59:01Z","title":"Large Language Models(LLMs) on Tabular Data: Prediction, Generation, and Understanding -- A Survey","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17944","snapshot_observed_at":"2026-08-06T17:43:53.677611Z","title":"arXiv:2402.17944 [cs.CL] https://arxiv.org/abs/ 2402.17944","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T17:43:53.677611Z"},"links":{"cited_paper":"/paper/2402.17944","citing_paper":"/paper/2507.10088"},"observation_digest":"sha256:a667ce8ea68b71612927f065d045091c2d8dbc1fccbeaad51f6322cfcce02f9a","observation_id":"5c63c5e1-b91e-4884-9344-0835111c1527","resolution":{"observed_at":"2026-08-06T17:43:53.677611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.10088","last_updated":"2025-07-14T09:15:22Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T17:37:25.079459Z","submitted_at":"2025-07-14T09:15:22Z","title":"Towards High Supervised Learning Utility Training Data Generation: Data Pruning and Column Reordering"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":5,"metadata_mismatch":5,"parse_uncertain":0,"unresolved":53,"verified_exact":12,"verified_fuzzy":6},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 0 inbound Pith citation observations for arXiv:2507.10088."}