{"as_of":"2026-08-08T04:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:70fc4530256ab50eac02c1d2f19d9616b28b0204ca69edd69b65e224e498813e","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:09:33.588670Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T00:49:17.695166Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2308.12067","last_updated":"2026-04-12T14:13:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-23T11:27:30Z","title":"MM-LIMA: Less Is More for Alignment in Multi-Modal Datasets","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T08:13:18.191233Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2308.12067"},"observation_digest":"sha256:e52b0ef39275856366f57a5b88e3118c2ea400d47afa79e2350166fbe9f886c2","observation_id":"42bb65dc-b14d-4987-9e6b-99e210376ade","resolution":{"observed_at":"2026-05-24T08:14:10.175046Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2309.01219","last_updated":"2025-09-14T09:34:46Z","snapshot_observed_at":"2026-07-06T16:13:46.112815Z","submitted_at":"2023-09-03T16:56:48Z","title":"Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-12T14:21:16.453610Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2309.01219"},"observation_digest":"sha256:78c2c1108ec8260e7a172e9e3180bfa92283c24c2e9956eaddd2f94ff35e03a4","observation_id":"d84fe3e4-cad7-4bb8-9fc6-41793cf5e71c","resolution":{"observed_at":"2026-05-12T14:21:16.542943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2503.07557","last_updated":"2026-05-02T15:43:17Z","snapshot_observed_at":"2026-08-03T10:34:14.204884Z","submitted_at":"2025-03-10T17:27:17Z","title":"AutoSpatial: Visual-Language Reasoning for Social Robot Navigation through Efficient Spatial Reasoning Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-23T00:26:58.273861Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2503.07557"},"observation_digest":"sha256:df7acdb1758f8cccbcdd0c8da98ef00716ee14d532873591d438c8be3f20bb1b","observation_id":"663ff74e-816e-4d2d-b2e6-29d3f9ee6239","resolution":{"observed_at":"2026-05-23T00:27:17.816053Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T15:09:33.588670Z","title":"Instruction mining: Instruction data selection for tuning large language models.arXiv preprint arXiv:2307.06290, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16066","last_updated":"2025-05-21T22:34:13Z","snapshot_observed_at":"2026-08-07T15:05:27.211434Z","submitted_at":"2025-05-21T22:34:13Z","title":"Merge to Mix: Mixing Datasets via Model Merging","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:33.588670Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.16066"},"observation_digest":"sha256:3a1b7aac986932a9b6c557f38247cc067d7ad26710132bb958c142ceca706305","observation_id":"19e4d153-5cdb-476e-96c9-1d8cd985172b","resolution":{"observed_at":"2026-08-07T15:09:33.588670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:58:32.633147Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16849","last_updated":"2025-05-28T07:44:23Z","snapshot_observed_at":"2026-08-07T14:51:51.125807Z","submitted_at":"2025-05-22T16:11:35Z","title":"Walk&Retrieve: Simple Yet Effective Zero-shot Retrieval-Augmented Generation via Knowledge Graph Walks","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:32.633147Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.16849"},"observation_digest":"sha256:a28c621b169b8939b3ba1826b7c6c0f13a78b50fe42e1da2444ac695d280056a","observation_id":"11863cfa-4401-49d1-bde0-355e87d328c5","resolution":{"observed_at":"2026-08-07T14:58:32.633147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:33:12.899936Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18458","last_updated":"2025-06-01T16:00:34Z","snapshot_observed_at":"2026-08-07T20:59:19.597449Z","submitted_at":"2025-05-24T01:57:12Z","title":"A Survey of LLM $\\times$ DATA","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T14:33:12.899936Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.18458"},"observation_digest":"sha256:7997e5a64b95937349d0332b88a5f550ddd3c536a4e41f2da94bae24ed59acc1","observation_id":"16e7db2c-f332-4fa9-bbe5-5e83e1d9133f","resolution":{"observed_at":"2026-08-07T14:33:12.899936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:32:13.530356Z","title":"Hyung Won Chung, Le Hou, Shayne Longpre, Bar- ret Zoph, Yi Tay, William Fedus, Yunxuan Li, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18557","last_updated":"2025-06-02T11:00:28Z","snapshot_observed_at":"2026-08-07T14:27:20.619144Z","submitted_at":"2025-05-24T06:51:03Z","title":"TAG-INSTRUCT: Controlled Instruction Complexity Enhancement through Structure-based Augmentation","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:32:13.530356Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.18557"},"observation_digest":"sha256:105f0cc9620cf918c82eb70c6ea7abdc7c0131cca6b4bd031277d656997580f5","observation_id":"99126653-6042-4339-a9fe-071207acb0c2","resolution":{"observed_at":"2026-08-07T14:32:13.530356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:25:21.464252Z","title":"Instruction mining: Instruction data selection for tuning large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19051","last_updated":"2025-05-25T09:08:00Z","snapshot_observed_at":"2026-08-07T22:50:03.044224Z","submitted_at":"2025-05-25T09:08:00Z","title":"Efficient Data Selection at Scale via Influence Distillation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:25:21.464252Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.19051"},"observation_digest":"sha256:8cfa6a95b42dc597861d17899ed017cee9c947e2cc0269f1adbd09d58dfd99b5","observation_id":"4553c525-29a0-4827-8eaf-0364a95e7b86","resolution":{"observed_at":"2026-08-07T14:25:21.464252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T14:00:29.600015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20416","last_updated":"2025-05-26T18:06:50Z","snapshot_observed_at":"2026-08-07T13:52:46.937698Z","submitted_at":"2025-05-26T18:06:50Z","title":"GraphGen: Enhancing Supervised Fine-Tuning for LLMs with Knowledge-Driven Synthetic Data Generation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:00:29.600015Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2505.20416"},"observation_digest":"sha256:b747aa60b19f45042f6f3fd79b63937538a7b1d092a0e1d8a1410f30a7bf58ee","observation_id":"c2e9f62e-708f-4c21-84bc-ea1c79d19ced","resolution":{"observed_at":"2026-08-07T14:00:29.600015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T04:55:35.093796Z","title":"Instruction mining: High-quality instruc- tion data selection for large language models.arXiv preprint arXiv:2307.06290, 1(3):6, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-07T04:48:43.411264Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.093796Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e703b965c70238e3eb0bdc80e988e9ea95dd82795e620b482b8184e3a4e2efc1","observation_id":"dcf1a6d7-877f-4d33-8226-a98385e3554e","resolution":{"observed_at":"2026-08-07T04:55:35.093796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T04:37:06.226403Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10288","last_updated":"2025-06-12T01:53:01Z","snapshot_observed_at":"2026-08-07T04:27:46.870736Z","submitted_at":"2025-06-12T01:53:01Z","title":"ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:37:06.226403Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2506.10288"},"observation_digest":"sha256:a1a75da34c16b99d5f1401a600bc4af029b07a766d610e0e972ec29c6c2bb73f","observation_id":"08b7ce6f-70e8-4e2e-a172-63c699e58f94","resolution":{"observed_at":"2026-08-07T04:37:06.226403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2605.05227","last_updated":"2026-04-19T14:23:23Z","snapshot_observed_at":"2026-08-02T14:54:36.818075Z","submitted_at":"2026-04-19T14:23:23Z","title":"Rethinking Data Curation in LLM Training: Online Reweighting Offers Better Generalization than Offline Methods","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T07:09:21.652035Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2605.05227"},"observation_digest":"sha256:0318166f429db1c671580dbcb32ea0236c10bb334959d1946705471ea2778b4e","observation_id":"6f4c6a3d-937d-4a27-aa13-7b627447d7d4","resolution":{"observed_at":"2026-05-10T07:11:53.337299Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2605.07063","last_updated":"2026-05-08T00:16:11Z","snapshot_observed_at":"2026-07-31T19:38:37.065573Z","submitted_at":"2026-05-08T00:16:11Z","title":"Dr. Post-Training: A Data Regularization Perspective on LLM Post-Training","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-05-11T01:57:40.347786Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2605.07063"},"observation_digest":"sha256:9b1c2973f7fd65cb191b60367840ac3930312b0732495274b5ffc8387a2fcf46","observation_id":"c5140b54-8b76-4bc2-b6de-0770784267e3","resolution":{"observed_at":"2026-05-11T04:05:56.776981Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2606.07690","last_updated":"2026-06-05T06:31:43Z","snapshot_observed_at":"2026-08-05T05:05:33.849870Z","submitted_at":"2026-06-05T06:31:43Z","title":"HARP: Efficient Data Selection for Finetuning Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T22:49:48.330530Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2606.07690"},"observation_digest":"sha256:a4032c5a7cd98e488a3759824a8fea431db9f96618b8164609fa8d931d18efb1","observation_id":"8fb8b7cc-7eab-476a-8ced-be9e00067922","resolution":{"observed_at":"2026-07-02T16:17:09.376334Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2606.08574","last_updated":"2026-06-07T11:11:51Z","snapshot_observed_at":"2026-08-03T13:39:16.935988Z","submitted_at":"2026-06-07T11:11:51Z","title":"OrderDP: A Theoretically Guaranteed Lossless Dynamic Data Pruning Framework","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-06-27T18:26:32.883834Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2606.08574"},"observation_digest":"sha256:d779707528d74c729ed0597389c1bf75b205cc9653c49ceb8cbcb39738434064","observation_id":"23a3e80d-cb90-470b-b2e4-916a38cdbe6e","resolution":{"observed_at":"2026-07-02T23:07:27.187260Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":"2307.06290","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-07-04T00:49:17.695166Z","title":"Instruction mining: High-quality instruction data selection for large language models","venue":null,"work_id":"4e60fb70-a2e5-46f0-a565-b964abb8d458","year":2023},"citing_paper":{"arxiv_id":"2606.19549","last_updated":"2026-06-17T19:40:51Z","snapshot_observed_at":"2026-08-02T14:09:04.600861Z","submitted_at":"2026-06-17T19:40:51Z","title":"Predicting Mergeability of Parameter-Efficient Fine-Tuning Updates","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-26T21:01:04.043286Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2606.19549"},"observation_digest":"sha256:840d04814983d80e3c71e32c63a7ddf4172eba89975d88c802a17781c5023f8b","observation_id":"c43ee3e2-8d64-4b29-9e90-8c920ad234a8","resolution":{"observed_at":"2026-07-04T00:49:17.697551Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-01T13:54:03.003356Z","title":"Instruction mining: High-quality instruction data selection for large language models.arXiv preprint arXiv:2307.06290, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.18960","last_updated":"2026-07-21T10:52:04Z","snapshot_observed_at":"2026-08-06T12:53:41.666185Z","submitted_at":"2026-07-21T10:52:04Z","title":"SFGA: A Statistics-First Gating Architecture with Adjudicative Escalation for Trustworthy SFT Data Procurement","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T13:54:03.003356Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2607.18960"},"observation_digest":"sha256:b4ee1c0ac243690a4ca79647c92c00ce629d93b86545d5b703e0c6cd70a34775","observation_id":"fbf07f84-e4e4-41be-85f1-9f0fef4c3c2c","resolution":{"observed_at":"2026-08-01T13:54:03.003356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2307.06290/citation-record","integrity":"/paper/2307.06290/integrity","json":"/paper/2307.06290/citation-record.json","paper":"/paper/2307.06290"},"outbound":[],"paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T15:53:19.485466Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2307.06290."}