{"as_of":"2026-08-08T21:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:85619c32d5f72ab1142540749c89731e3b375d9e8cc826c305dbba3fb4d2515b","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:25:18.318477Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T19:18:54.703277Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2503.01807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-07-03T19:18:54.703277Z","title":"W., and Dasigi, P","venue":null,"work_id":"bbdaf4c4-707a-48a9-bced-5db8a7e8f129","year":2025},"citing_paper":{"arxiv_id":"2504.20571","last_updated":"2025-10-24T10:02:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-29T09:24:30Z","title":"Reinforcement Learning for Reasoning in Large Language Models with One Training Example","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-15T19:51:04.779597Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2504.20571"},"observation_digest":"sha256:50e17f1a19d6f2652c0ee551e5072bdd40d8bb0c32a7594e9d35a25a416147c1","observation_id":"7ad7eead-b72b-4edc-ab2d-e2114b9f9814","resolution":{"observed_at":"2026-05-15T19:51:05.034374Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-08-07T14:25:18.318477Z","title":"Large-scale data selection for instruction tuning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19051","last_updated":"2025-05-25T09:08:00Z","snapshot_observed_at":"2026-08-07T22:50:03.044224Z","submitted_at":"2025-05-25T09:08:00Z","title":"Efficient Data Selection at Scale via Influence Distillation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:25:18.318477Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2505.19051"},"observation_digest":"sha256:59ea5d2f9bfb3c09e7162460565dd3b2aef15e2c62dbb1208c0d7ad980f2a1f1","observation_id":"1842ce34-e2e5-4790-8ad3-bdc80f01ace0","resolution":{"observed_at":"2026-08-07T14:25:18.318477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-08-07T11:33:54.560575Z","title":"Large-scale data selection for instruction tuning.arXiv preprint arXiv:2503.01807,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02177","last_updated":"2025-06-02T19:03:00Z","snapshot_observed_at":"2026-08-07T16:09:18.755046Z","submitted_at":"2025-06-02T19:03:00Z","title":"Act Only When It Pays: Efficient Reinforcement Learning for LLM Reasoning via Selective Rollouts","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:33:54.560575Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2506.02177"},"observation_digest":"sha256:311f441d8933b64b20ba702e72e5e6f80ecf4d2186e219cf9823554380c63b2c","observation_id":"9b82e5ce-5627-4432-acbb-de0cc0225403","resolution":{"observed_at":"2026-08-07T11:33:54.560575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-08-06T19:07:35.904174Z","title":"Hamish Ivison, Muru Zhang, Faeze Brahman, Pang Wei Koh, and Pradeep Dasigi","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06573","last_updated":"2025-07-09T06:05:28Z","snapshot_observed_at":"2026-08-07T21:25:23.216182Z","submitted_at":"2025-07-09T06:05:28Z","title":"From Data-Centric to Sample-Centric: Enhancing LLM Reasoning via Progressive Optimization","version":1},"reference_index":9061,"source":"pdf_text","source_observed_at":"2026-08-06T19:07:35.904174Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2507.06573"},"observation_digest":"sha256:14521d702927259de3f321402a6e05b908db137c96e72785422b8381d199b7b1","observation_id":"f738fbeb-dc33-4e5b-9782-9a22379c6465","resolution":{"observed_at":"2026-08-06T19:07:35.904174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-08-04T10:09:02.113206Z","title":"Large-scale data selection for instruction tuning.arXiv preprint arXiv:2503.01807,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.11686","last_updated":"2026-07-15T17:43:29Z","snapshot_observed_at":"2026-08-08T16:17:52.499482Z","submitted_at":"2025-10-13T17:49:05Z","title":"Representation-Based Exploration for Language Models: From Test-Time to Post-Training","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T10:09:02.113206Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2510.11686"},"observation_digest":"sha256:dc2e4955e1f0765663aa25d30b4f62b2f69e94654ec06bf2391161ec08d81abd","observation_id":"97269dc6-35f8-4512-a8c4-85965883311d","resolution":{"observed_at":"2026-08-04T10:09:02.113206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2503.01807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-07-03T19:18:54.703277Z","title":"W., and Dasigi, P","venue":null,"work_id":"bbdaf4c4-707a-48a9-bced-5db8a7e8f129","year":2025},"citing_paper":{"arxiv_id":"2602.03452","last_updated":"2026-05-06T05:26:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-03T12:17:25Z","title":"Beyond Variance: Prompt-Efficient RLVR via Rare-Event Amplification and Bidirectional Pairing","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T08:24:50.793194Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2602.03452"},"observation_digest":"sha256:d7b0db41ab35aa2d78545ccf710c7c06aaa309adef9740efb71b3f3a840095d7","observation_id":"03322189-9972-4a5d-b58a-f2ff05623527","resolution":{"observed_at":"2026-05-16T08:27:36.777923Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-08-02T23:11:01.819873Z","title":"W., and Dasigi, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14696","last_updated":"2026-06-18T11:23:03Z","snapshot_observed_at":"2026-08-03T23:41:17.421883Z","submitted_at":"2026-02-16T12:33:05Z","title":"A Critical Look at Targeted Instruction Selection: Disentangling What Matters (and What Doesn't)","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T23:11:01.819873Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2602.14696"},"observation_digest":"sha256:6a163e2f51c375e561a4a42138078c4d9b3cc105a4c85eee13239e858d22f958","observation_id":"1108d41d-d4f1-41b3-ba62-3f044b1bb4aa","resolution":{"observed_at":"2026-08-02T23:11:01.819873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2503.01807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-07-03T19:18:54.703277Z","title":"W., and Dasigi, P","venue":null,"work_id":"bbdaf4c4-707a-48a9-bced-5db8a7e8f129","year":2025},"citing_paper":{"arxiv_id":"2602.18584","last_updated":"2026-05-16T01:08:46Z","snapshot_observed_at":"2026-08-02T09:38:59.455163Z","submitted_at":"2026-02-20T19:44:24Z","title":"GIST: Targeted Data Selection for Instruction Tuning via Coupled Optimization Geometry","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T12:26:14.261351Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2602.18584"},"observation_digest":"sha256:d43dd91748333a66edc7240264f7a479dbefe56eb057e2e1e5dcb5498aa95cd3","observation_id":"2121ec55-7757-4c87-bb49-76cae12a4cac","resolution":{"observed_at":"2026-05-21T12:30:07.830594Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2503.01807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-07-03T19:18:54.703277Z","title":"W., and Dasigi, P","venue":null,"work_id":"bbdaf4c4-707a-48a9-bced-5db8a7e8f129","year":2025},"citing_paper":{"arxiv_id":"2604.17928","last_updated":"2026-04-20T08:09:01Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T08:09:01Z","title":"HEALing Entropy Collapse: Enhancing Exploration in Few-Shot RLVR via Hybrid-Domain Entropy Dynamics Alignment","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-10T05:23:08.478393Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2604.17928"},"observation_digest":"sha256:e35eb0fdd22c4ae470eeab6089adfe64181e4b621c633f0366ee0ccb3974a61c","observation_id":"d69dcf57-71e5-44be-b66e-80b36958618d","resolution":{"observed_at":"2026-05-10T05:25:55.324943Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2503.01807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-07-03T19:18:54.703277Z","title":"W., and Dasigi, P","venue":null,"work_id":"bbdaf4c4-707a-48a9-bced-5db8a7e8f129","year":2025},"citing_paper":{"arxiv_id":"2605.05227","last_updated":"2026-04-19T14:23:23Z","snapshot_observed_at":"2026-08-08T19:40:12.238501Z","submitted_at":"2026-04-19T14:23:23Z","title":"Rethinking Data Curation in LLM Training: Online Reweighting Offers Better Generalization than Offline Methods","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T07:09:21.652035Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2605.05227"},"observation_digest":"sha256:392cfaa7ef54add705088ed82be5eb3d5c418893f9f2ff5814f725acb4af6b29","observation_id":"1fdc3812-c306-436b-8e12-d3c10b6774ef","resolution":{"observed_at":"2026-05-10T07:11:53.295981Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2503.01807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-07-03T19:18:54.703277Z","title":"W., and Dasigi, P","venue":null,"work_id":"bbdaf4c4-707a-48a9-bced-5db8a7e8f129","year":2025},"citing_paper":{"arxiv_id":"2605.12944","last_updated":"2026-05-13T03:27:21Z","snapshot_observed_at":"2026-07-06T23:24:32.412966Z","submitted_at":"2026-05-13T03:27:21Z","title":"From Instance Selection to Fixed-Pool Data Recipe Search for Supervised Fine-Tuning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-14T20:37:55.057366Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2605.12944"},"observation_digest":"sha256:f03179c2054273bec4c3cd91930ab133a053d312f7e777fd01f7c18f5facf542","observation_id":"6e64941c-a5cc-42a1-864f-11bb86ad213a","resolution":{"observed_at":"2026-05-14T20:39:26.646591Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2503.01807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-07-03T19:18:54.703277Z","title":"W., and Dasigi, P","venue":null,"work_id":"bbdaf4c4-707a-48a9-bced-5db8a7e8f129","year":2025},"citing_paper":{"arxiv_id":"2605.15675","last_updated":"2026-05-15T06:54:15Z","snapshot_observed_at":"2026-07-06T23:26:56.013191Z","submitted_at":"2026-05-15T06:54:15Z","title":"Interaction-Aware Influence Functions for Group Attribution","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-20T20:42:10.718326Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2605.15675"},"observation_digest":"sha256:1a8317ae9bb4b32fd48670cfef8f1b8fe7dc4128580a724f5b151eb813049a78","observation_id":"b6c1d0a4-ad02-4edc-8f6d-ee9ec135dc86","resolution":{"observed_at":"2026-05-20T20:43:43.371750Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2503.01807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-07-03T19:18:54.703277Z","title":"W., and Dasigi, P","venue":null,"work_id":"bbdaf4c4-707a-48a9-bced-5db8a7e8f129","year":2025},"citing_paper":{"arxiv_id":"2606.13668","last_updated":"2026-06-11T17:58:33Z","snapshot_observed_at":"2026-07-06T23:52:23.981568Z","submitted_at":"2026-06-11T17:58:33Z","title":"Influcoder: Distilling Decoders' Gradient Influence Rankings into an Encoder for Data Attribution","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-27T06:32:56.852902Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2606.13668"},"observation_digest":"sha256:ff39fc507b3f5095e4fdff68cb8ccda9e21b27d860c6d5bf6233eae0433ba117","observation_id":"30e85dec-c936-4e00-9512-d3ed93f80936","resolution":{"observed_at":"2026-07-03T15:18:33.873958Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning","version":2},"cited_work":{"arxiv_id":"2503.01807","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01807","snapshot_observed_at":"2026-07-03T19:18:54.703277Z","title":"W., and Dasigi, P","venue":null,"work_id":"bbdaf4c4-707a-48a9-bced-5db8a7e8f129","year":2025},"citing_paper":{"arxiv_id":"2606.18307","last_updated":"2026-06-16T07:21:49Z","snapshot_observed_at":"2026-07-06T23:53:45.117607Z","submitted_at":"2026-06-16T07:21:49Z","title":"DRIFT: Refining Instruction Data via On-Policy Data Attribution","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T01:57:05.784589Z"},"links":{"cited_paper":"/paper/2503.01807","citing_paper":"/paper/2606.18307"},"observation_digest":"sha256:7ca654e9a65db988600aa3af3b25e3a41890bb62453bb4c1fc259bf3c9db7111","observation_id":"74abf2df-c0fe-41ff-947b-3f04142e9b2e","resolution":{"observed_at":"2026-07-03T19:18:54.705014Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2503.01807/citation-record","integrity":"/paper/2503.01807/integrity","json":"/paper/2503.01807/citation-record.json","paper":"/paper/2503.01807"},"outbound":[],"paper":{"arxiv_id":"2503.01807","last_updated":"2025-06-19T04:19:15Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T01:22:30.771699Z","submitted_at":"2025-03-03T18:37:26Z","title":"Large-Scale Data Selection for Instruction Tuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2503.01807."}