{"as_of":"2026-08-21T08:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f91c44e3ff8aafd5fd1c3ce74f5fdacad742c15b31f60d62463a6aac4414d92","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":80,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":80,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":80,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:29:51.783032Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":14,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2402.19473","last_updated":"2024-06-21T08:26:36Z","snapshot_observed_at":"2026-08-20T12:47:05.152771Z","submitted_at":"2024-02-29T18:59:01Z","title":"Retrieval-Augmented Generation for AI-Generated Content: A Survey","version":6},"reference_index":130,"source":"pdf_text","source_observed_at":"2026-05-15T13:32:17.177021Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2402.19473"},"observation_digest":"sha256:2dbd573d4c02e5a3a89aacf6c72075de5346c3c773f319c4ec017a753c366889","observation_id":"cfa146e5-5021-43a3-8ee1-770efa704979","resolution":{"observed_at":"2026-05-15T13:32:17.369856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-12T19:14:37.068426Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.10914","last_updated":"2025-02-20T06:07:41Z","snapshot_observed_at":"2026-08-19T11:10:05.652421Z","submitted_at":"2024-11-16T23:53:27Z","title":"BPO: Towards Balanced Preference Optimization between Knowledge Breadth and Depth in Alignment","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T19:14:37.068426Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2411.10914"},"observation_digest":"sha256:d43d924e5081f485a8af1757c4923ca863f9fb67d6abbf5ead63f65d59f73f58","observation_id":"7052df9d-d093-454c-86e8-712b6a15f902","resolution":{"observed_at":"2026-08-12T19:14:37.068426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-12T15:58:03.299039Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14497","last_updated":"2024-11-21T02:30:53Z","snapshot_observed_at":"2026-08-19T08:12:28.412037Z","submitted_at":"2024-11-21T02:30:53Z","title":"Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T15:58:03.299039Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2411.14497"},"observation_digest":"sha256:b2773208df9223b4664d6ebd86508148ad9969ce72ea75c3d9ca86a4ebe10455","observation_id":"91040c02-dd05-4c54-9924-57e20f97a625","resolution":{"observed_at":"2026-08-12T15:58:03.299039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-12T05:13:41.578831Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00631","last_updated":"2025-08-29T17:58:46Z","snapshot_observed_at":"2026-08-18T19:54:37.058880Z","submitted_at":"2024-12-01T01:01:09Z","title":"ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T05:13:41.578831Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.00631"},"observation_digest":"sha256:9307044d7fca89f709bc8e528da3e4e93b6ade9cbfb556c052bd97357a1680f4","observation_id":"60badec1-eec3-4c83-841d-ecd57ffc2dbc","resolution":{"observed_at":"2026-08-12T05:13:41.578831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T19:54:52.058857Z","title":"Less: Selecting influen- tial data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06293","last_updated":"2025-08-14T01:57:38Z","snapshot_observed_at":"2026-08-16T21:31:50.361344Z","submitted_at":"2024-12-09T08:36:10Z","title":"Mastering Collaborative Multi-modal Data Selection: A Focus on Informativeness, Uniqueness, and Representativeness","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T19:54:52.058857Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.06293"},"observation_digest":"sha256:1127c23693c979ed18975147249f88836700800707944b157f8abb2e0581d1ab","observation_id":"b9b02ac0-e4d5-459e-b5fa-e9caeb710396","resolution":{"observed_at":"2026-08-11T19:54:52.058857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T14:02:43.932718Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.12541","last_updated":"2024-12-17T05:09:07Z","snapshot_observed_at":"2026-08-18T12:42:25.457045Z","submitted_at":"2024-12-17T05:09:07Z","title":"LLMCL-GEC: Advancing Grammatical Error Correction with LLM-Driven Curriculum Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T14:02:43.932718Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.12541"},"observation_digest":"sha256:990caca0f1fb217e25b290616b952339a979468af88dc33f987cd0e7a822b04a","observation_id":"5a998296-4a9a-4b9f-9064-4db61e7354f1","resolution":{"observed_at":"2026-08-11T14:02:43.932718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T12:05:48.554007Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14689","last_updated":"2025-05-28T05:22:58Z","snapshot_observed_at":"2026-08-15T08:21:08.511659Z","submitted_at":"2024-12-19T09:43:39Z","title":"How to Synthesize Text Data without Model Collapse?","version":3},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T12:05:48.554007Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.14689"},"observation_digest":"sha256:6a61060b660b1e645fa9d84dfe47fa3e6f31856d0e969fbb469aa4d86a5865ca","observation_id":"506b9688-31f3-41b4-acab-8cf59a1f6c4c","resolution":{"observed_at":"2026-08-11T12:05:48.554007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T11:59:28.468647Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14809","last_updated":"2025-01-24T13:54:05Z","snapshot_observed_at":"2026-08-18T11:13:27.223623Z","submitted_at":"2024-12-19T12:57:47Z","title":"ResoFilter: Fine-grained Synthetic Data Filtering for Large Language Models through Data-Parameter Resonance Analysis","version":3},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T11:59:28.468647Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.14809"},"observation_digest":"sha256:dbba0495f683184136d8b4e029d5d56a67712297cbcae482142f2b78f57379cd","observation_id":"6f5105b7-fb81-4494-bec3-1497ff23ea11","resolution":{"observed_at":"2026-08-11T11:59:28.468647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T11:51:02.962175Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.14922","last_updated":"2024-12-19T15:00:18Z","snapshot_observed_at":"2026-08-18T03:47:11.799476Z","submitted_at":"2024-12-19T15:00:18Z","title":"RobustFT: Robust Supervised Fine-tuning for Large Language Models under Noisy Response","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T11:51:02.962175Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.14922"},"observation_digest":"sha256:f75005b77c39510ff2f7bfd85ea01e87930fe7bbc8f5a86799e5f39b7ad349a8","observation_id":"ee33c58c-b071-4cec-9b85-655741650ca0","resolution":{"observed_at":"2026-08-11T11:51:02.962175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T11:18:35.618509Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.15652","last_updated":"2024-12-20T08:07:11Z","snapshot_observed_at":"2026-08-19T18:47:39.592738Z","submitted_at":"2024-12-20T08:07:11Z","title":"Error-driven Data-efficient Large Multimodal Model Tuning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-11T11:18:35.618509Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2412.15652"},"observation_digest":"sha256:09fadc88f1a1e378904e0ffb49087245fd418330669b1764c89e2171667fb645","observation_id":"c249a302-567d-49ea-a5f7-c1bb3654e406","resolution":{"observed_at":"2026-08-11T11:18:35.618509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-10T21:02:00.908041Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.06708","last_updated":"2026-05-25T22:00:48Z","snapshot_observed_at":"2026-08-17T03:31:02.136201Z","submitted_at":"2025-01-12T04:28:14Z","title":"Evaluating Sample Utility for Efficient Data Selection by Mimicking Model Weights","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:02:00.908041Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2501.06708"},"observation_digest":"sha256:621dbbc1df04bcf96ece14ee53b8033e97aa8cca63998bfcaa12ffd6be5b7587","observation_id":"84e65fbf-ae62-405c-87bc-d30ba4b33810","resolution":{"observed_at":"2026-08-10T21:02:00.908041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-10T20:14:59.398548Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.09223","last_updated":"2025-06-15T13:24:11Z","snapshot_observed_at":"2026-08-15T10:26:22.406164Z","submitted_at":"2025-01-16T01:03:56Z","title":"Foundations of Large Language Models","version":2},"reference_index":269,"source":"arxiv_source","source_observed_at":"2026-08-10T20:14:59.398548Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2501.09223"},"observation_digest":"sha256:d53341eae71b1a2ede1fa35c6f43c8d92322eceadb7776a629fb902192c7a1ef","observation_id":"026e0e28-e136-4351-8f29-181c598f4b92","resolution":{"observed_at":"2026-08-10T20:14:59.398548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-10T17:34:52.508784Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12147","last_updated":"2026-08-17T05:29:10Z","snapshot_observed_at":"2026-08-20T23:11:50.730948Z","submitted_at":"2025-01-21T14:00:43Z","title":"Improving Influence-based Instruction Tuning Data Selection for Balanced Learning of Diverse Capabilities","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-10T17:34:52.508784Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2501.12147"},"observation_digest":"sha256:44a4f1162c85c64098bc0f686d3f6ed65972053807cb4a5bb41d62ba2f699458","observation_id":"233e79e0-c43a-4119-be56-18093fa30945","resolution":{"observed_at":"2026-08-10T17:34:52.508784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-09T23:02:23.441499Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18578","last_updated":"2025-02-26T18:58:53Z","snapshot_observed_at":"2026-08-17T15:14:37.183066Z","submitted_at":"2025-01-30T18:50:25Z","title":"R.I.P.: Better Models by Survival of the Fittest Prompts","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T23:02:23.441499Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2501.18578"},"observation_digest":"sha256:f777f73ffd0906ffe930b9718d0539c71cc83e5f01a42276143518f237fe5859","observation_id":"843288a1-07cf-45c3-a358-a839a71c8e79","resolution":{"observed_at":"2026-08-09T23:02:23.441499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-09T20:29:52.691742Z","title":"LESS: selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00089","last_updated":"2025-01-31T18:07:21Z","snapshot_observed_at":"2026-08-09T20:21:06.208133Z","submitted_at":"2025-01-31T18:07:21Z","title":"Ensembles of Low-Rank Expert Adapters","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-09T20:29:52.691742Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2502.00089"},"observation_digest":"sha256:b27a56db31326a0b63d15e30ee3145b87a563f878625558d444a342d16bd98f3","observation_id":"26a3a64c-2735-40c2-a3ad-a760e24418ad","resolution":{"observed_at":"2026-08-09T20:29:52.691742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2502.00270","last_updated":"2026-05-13T20:43:28Z","snapshot_observed_at":"2026-08-15T02:12:27.239496Z","submitted_at":"2025-02-01T01:52:32Z","title":"DUET: Optimizing Training Data Mixtures via Feedback from Unseen Evaluation Tasks","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-23T03:58:48.967122Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2502.00270"},"observation_digest":"sha256:8279886ee4907d65241fe43f7fae882c51132835873460becf287956d9866bb5","observation_id":"45275c11-40ac-4f3e-8466-13e544982167","resolution":{"observed_at":"2026-05-23T04:02:30.502624Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-08T17:31:59.904624Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05911","last_updated":"2025-02-09T14:11:30Z","snapshot_observed_at":"2026-08-18T00:50:00.046974Z","submitted_at":"2025-02-09T14:11:30Z","title":"GRAIT: Gradient-Driven Refusal-Aware Instruction Tuning for Effective Hallucination Mitigation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T17:31:59.904624Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2502.05911"},"observation_digest":"sha256:4263a02cad62c39f4570e27dabc1ca5601851a61ebe827dc36544be35cddde6a","observation_id":"11ccd4aa-1365-4999-b946-c001122c4f81","resolution":{"observed_at":"2026-08-08T17:31:59.904624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2502.10248","last_updated":"2025-02-24T10:12:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-14T15:58:10Z","title":"Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model","version":3},"reference_index":223,"source":"arxiv_source","source_observed_at":"2026-05-19T08:02:23.002090Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2502.10248"},"observation_digest":"sha256:aeacd15fc34e515ba4013adb7af82b53a9e6796803c1d4f91ae8594310e062f4","observation_id":"bc7838af-4d9d-4ff1-ba19-5ec589007993","resolution":{"observed_at":"2026-05-19T08:02:23.531239Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-16T12:29:51.783032Z","title":"Less: Selecting influential data for targeted instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.12687","last_updated":"2025-04-17T06:29:28Z","snapshot_observed_at":"2026-08-20T17:37:55.514030Z","submitted_at":"2025-04-17T06:29:28Z","title":"Data-efficient LLM Fine-tuning for Code Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:29:51.783032Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2504.12687"},"observation_digest":"sha256:1506e5f93b6b86cf538c9b24d69e6dffc2b40ed9a10404bc28e7f3bbb9855e26","observation_id":"1c5560d7-8c6b-472b-ad48-2e96db58f920","resolution":{"observed_at":"2026-08-16T12:29:51.783032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-16T11:46:10.993352Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14810","last_updated":"2025-08-08T13:29:20Z","snapshot_observed_at":"2026-08-20T12:57:00.461648Z","submitted_at":"2025-04-21T02:25:03Z","title":"DONOD: Efficient and Generalizable Instruction Fine-Tuning for LLMs via Model-Intrinsic Dataset Pruning","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-16T11:46:10.993352Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2504.14810"},"observation_digest":"sha256:2f8e370550a98161980f17d543e324307a8adb6a0aa4fa850f93db3d2de44083","observation_id":"81f2f5b7-1049-4dce-b663-bcf934e9c5e3","resolution":{"observed_at":"2026-08-16T11:46:10.993352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-16T04:49:32.984118Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.00358","last_updated":"2025-05-01T07:08:19Z","snapshot_observed_at":"2026-08-18T18:58:21.785291Z","submitted_at":"2025-05-01T07:08:19Z","title":"R&B: Domain Regrouping and Data Mixture Balancing for Efficient Foundation Model Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T04:49:32.984118Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.00358"},"observation_digest":"sha256:b22beb502d7284a27e1906ecfc38a308597cd7c84b0e78bc2f9d01c36a12d5d3","observation_id":"432ae583-2d6a-4763-9dc0-3ca9eee05459","resolution":{"observed_at":"2026-08-16T04:49:32.984118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-16T01:09:03.312234Z","title":"LESS: selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.02118","last_updated":"2025-08-06T11:31:36Z","snapshot_observed_at":"2026-08-19T18:16:35.495377Z","submitted_at":"2025-05-04T14:00:04Z","title":"Adversarial Cooperative Rationalization: The Risk of Spurious Correlations in Even Clean Datasets","version":5},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-16T01:09:03.312234Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.02118"},"observation_digest":"sha256:c57af56e16f916ffe7ee74e647403f673e314cf903b71cf25f66a0f21611652c","observation_id":"c6de88d6-fa5e-4c34-9016-6309d0cb2f41","resolution":{"observed_at":"2026-08-16T01:09:03.312234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-15T23:12:39.076022Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05327","last_updated":"2025-05-18T11:24:09Z","snapshot_observed_at":"2026-08-18T08:02:49.248229Z","submitted_at":"2025-05-08T15:17:37Z","title":"RICo: Refined In-Context Contribution for Automatic Instruction-Tuning Data Selection","version":2},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T23:12:39.076022Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.05327"},"observation_digest":"sha256:617ff64c594f644735746bd9f443199f57268c6bba24d1c65183aa6957a5fe23","observation_id":"2fca783e-3bdc-445d-9915-86eaa1797c73","resolution":{"observed_at":"2026-08-15T23:12:39.076022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-15T20:37:48.240990Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12457","last_updated":"2025-05-18T15:14:58Z","snapshot_observed_at":"2026-08-15T20:31:10.596175Z","submitted_at":"2025-05-18T15:14:58Z","title":"UFO-RL: Uncertainty-Focused Optimization for Efficient Reinforcement Learning Data Selection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:37:48.240990Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.12457"},"observation_digest":"sha256:4c79d4724b394381d40a102bba11f29592fcc1bac9ffbd8b298e9230f7f1027b","observation_id":"987fb47c-4b71-49fe-a94a-b6cade2d47d0","resolution":{"observed_at":"2026-08-15T20:37:48.240990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-15T20:32:06.112224Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-21T01:23:16.185184Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.112224Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:02a12df98682162e0cde89067d5d1f944afb811998b78a96124d1c78a5529ade","observation_id":"58a20d5e-0717-4bd0-adc8-4543c0628660","resolution":{"observed_at":"2026-08-15T20:32:06.112224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-07T15:09:38.203646Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16066","last_updated":"2025-05-21T22:34:13Z","snapshot_observed_at":"2026-08-16T06:41:41.617586Z","submitted_at":"2025-05-21T22:34:13Z","title":"Merge to Mix: Mixing Datasets via Model Merging","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:38.203646Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.16066"},"observation_digest":"sha256:7839c407c25cddfb338aa1064e44151d633e59e82309b1253f77c85d04c427ff","observation_id":"44bd3a5a-7149-4c66-9ae8-22063bb3aeab","resolution":{"observed_at":"2026-08-07T15:09:38.203646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-15T22:08:55.882570Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17040","last_updated":"2025-05-13T01:00:12Z","snapshot_observed_at":"2026-08-20T04:45:28.447223Z","submitted_at":"2025-05-13T01:00:12Z","title":"Generalizing Large Language Model Usability Across Resource-Constrained","version":1},"reference_index":159,"source":"pdf_text","source_observed_at":"2026-08-15T22:08:55.882570Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.17040"},"observation_digest":"sha256:ef713036ecc3a989f880dbe59aea2e29e9257396bb713436600dbb473c358c23","observation_id":"6c0c0df7-4c2c-461c-8c2f-c99bf41c04c8","resolution":{"observed_at":"2026-08-15T22:08:55.882570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-07T14:25:17.393085Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19051","last_updated":"2025-05-25T09:08:00Z","snapshot_observed_at":"2026-08-20T01:26:59.525314Z","submitted_at":"2025-05-25T09:08:00Z","title":"Efficient Data Selection at Scale via Influence Distillation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:25:17.393085Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.19051"},"observation_digest":"sha256:5c88861fe4db83a35fc601c6904009fa99f4acdf61b6f7150ac79c2342df6607","observation_id":"8fbc55e1-4d0d-4961-b324-4f89de4aa9fe","resolution":{"observed_at":"2026-08-07T14:25:17.393085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-07T12:56:13.859762Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23223","last_updated":"2025-05-29T08:08:38Z","snapshot_observed_at":"2026-08-18T07:05:45.803782Z","submitted_at":"2025-05-29T08:08:38Z","title":"Daunce: Data Attribution through Uncertainty Estimation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:56:13.859762Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.23223"},"observation_digest":"sha256:4bedaa2349ddc871184ccfaa8ade77e2fa58d6f58c5cae5c6a007ee945ce88af","observation_id":"c9cb0f3c-ed17-41e1-a95f-d38187aef1da","resolution":{"observed_at":"2026-08-07T12:56:13.859762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-07T12:06:30.108486Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00577","last_updated":"2025-05-31T14:22:40Z","snapshot_observed_at":"2026-08-14T12:16:12.495445Z","submitted_at":"2025-05-31T14:22:40Z","title":"Reasoning Like an Economist: Post-Training on Economic Problems Induces Strategic Generalization in LLMs","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T12:06:30.108486Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2506.00577"},"observation_digest":"sha256:7e6e17c321b1724b7edc5a048750b1ae1dcee073bdd441a68d6c199ef1586f2d","observation_id":"3208fa00-3ea2-4407-a70c-a64010242d19","resolution":{"observed_at":"2026-08-07T12:06:30.108486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-07T11:45:03.259826Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.01701","last_updated":"2025-08-14T03:59:04Z","snapshot_observed_at":"2026-08-20T15:27:48.879374Z","submitted_at":"2025-06-02T14:06:42Z","title":"Data Pruning by Information Maximization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:45:03.259826Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2506.01701"},"observation_digest":"sha256:7654335aa8fbf1b82b36361ef7c68c87d2b64554adea34997e6bd4a274179de8","observation_id":"e0929f37-826d-4ac9-9b84-95733f5edd1e","resolution":{"observed_at":"2026-08-07T11:45:03.259826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-07T11:35:47.274238Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02096","last_updated":"2025-06-02T17:45:16Z","snapshot_observed_at":"2026-08-16T21:01:21.497825Z","submitted_at":"2025-06-02T17:45:16Z","title":"SynthRL: Scaling Visual Reasoning with Verifiable Data Synthesis","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T11:35:47.274238Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2506.02096"},"observation_digest":"sha256:addc92d2f78948e43f901ed50afd1bfbdba5b7a17e69410c91b26cd71dd6f001","observation_id":"1fd56d91-44f8-4727-9c8f-17c273d6c01f","resolution":{"observed_at":"2026-08-07T11:35:47.274238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-07T10:52:49.728829Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04205","last_updated":"2025-06-04T17:49:10Z","snapshot_observed_at":"2026-08-19T14:34:41.451189Z","submitted_at":"2025-06-04T17:49:10Z","title":"EPiC: Towards Lossless Speedup for Reasoning Training through Edge-Preserving CoT Condensation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:52:49.728829Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2506.04205"},"observation_digest":"sha256:ba5e144864ef8c4a6b3c1c04aea642d92689bd64a274ce57eee2a26e1902f4e7","observation_id":"c2e64d93-be90-45dc-b914-c03dbf45b9ce","resolution":{"observed_at":"2026-08-07T10:52:49.728829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-07T04:55:43.112708Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-21T00:39:51.114254Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":191,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:43.112708Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:2d0bcb087e77b240bd93e6bf0d9dc9aeb57bb8237c06b3008593d4b55632d8a6","observation_id":"875d1ffe-848a-4f5a-ae4b-74fde5b61074","resolution":{"observed_at":"2026-08-07T04:55:43.112708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-06T23:59:03.711431Z","title":"Less: Selecting influential data for targeted instruction tuning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15553","last_updated":"2025-06-18T15:26:43Z","snapshot_observed_at":"2026-08-20T02:31:36.996994Z","submitted_at":"2025-06-18T15:26:43Z","title":"Approximating Language Model Training Data from Weights","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T23:59:03.711431Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2506.15553"},"observation_digest":"sha256:ab1c80fad3de0048c25e8d7b362f5d4f9b7363340efc220c6d62a0da88a0a672","observation_id":"86930eeb-2581-4feb-8996-c825a2b0a21e","resolution":{"observed_at":"2026-08-06T23:59:03.711431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-15T18:39:18.992970Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00045","last_updated":"2025-06-23T22:05:21Z","snapshot_observed_at":"2026-08-20T17:33:27.320921Z","submitted_at":"2025-06-23T22:05:21Z","title":"CaughtCheating: Is Your MLLM a Good Cheating Detective? Exploring the Boundary of Visual Perception and Reasoning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T18:39:18.992970Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2507.00045"},"observation_digest":"sha256:224fde34a6ba713f3812a6a93c58bb20a062bffd33a6903239e6255873ffedfe","observation_id":"6089f827-694c-45b9-b258-ef70f3d67c75","resolution":{"observed_at":"2026-08-15T18:39:18.992970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-06T20:43:28.792871Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02173","last_updated":"2025-07-02T22:12:03Z","snapshot_observed_at":"2026-08-18T23:10:08.312871Z","submitted_at":"2025-07-02T22:12:03Z","title":"Data Diversification Methods In Alignment Enhance Math Performance In LLMs","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T20:43:28.792871Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2507.02173"},"observation_digest":"sha256:06e0b269ba762cb79420cf1d1e66834f718b229c8d88f2bf24b4dd3de42f217a","observation_id":"fd07e8cb-16c9-47e2-aeb9-a5b319f6dc64","resolution":{"observed_at":"2026-08-06T20:43:28.792871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-06T20:02:10.809020Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04059","last_updated":"2025-07-05T14:46:42Z","snapshot_observed_at":"2026-08-14T10:41:44.922838Z","submitted_at":"2025-07-05T14:46:42Z","title":"Attributing Data for Sharpness-Aware Minimization","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T20:02:10.809020Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2507.04059"},"observation_digest":"sha256:2253b5c5c90bf520cb382b14e506dd90bc9de7d9505c637001147b7193542eb5","observation_id":"a4b53896-a980-4e21-bb80-20510d0c1b40","resolution":{"observed_at":"2026-08-06T20:02:10.809020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-06T17:25:16.024557Z","title":"Less: Selecting influen- tial data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10904","last_updated":"2025-08-13T19:01:03Z","snapshot_observed_at":"2026-08-13T04:25:40.461381Z","submitted_at":"2025-07-15T01:43:32Z","title":"Class-Proportional Coreset Selection for Difficulty-Separable Data","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T17:25:16.024557Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2507.10904"},"observation_digest":"sha256:38e81339cc218911e563f70c3414fa82c811ae42ac2a7007b0f49b3535a2ea16","observation_id":"bea76b64-afea-4e70-826e-b5e3baf675e8","resolution":{"observed_at":"2026-08-06T17:25:16.024557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2508.04149","last_updated":"2026-05-16T09:55:19Z","snapshot_observed_at":"2026-08-18T01:41:11.813052Z","submitted_at":"2025-08-06T07:24:14Z","title":"Difficulty-Based Preference Data Selection by DPO Implicit Reward Gap","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T23:46:24.208438Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2508.04149"},"observation_digest":"sha256:cce83e56c61289871358fcfc95883b27689f1010df6ac9480667786be21ef342","observation_id":"39380165-d2f1-4710-8921-760b50e32e49","resolution":{"observed_at":"2026-05-21T23:50:47.542379Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T20:00:05.206082Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.11551","last_updated":"2025-08-18T06:38:38Z","snapshot_observed_at":"2026-08-13T22:41:43.529278Z","submitted_at":"2025-08-15T15:53:09Z","title":"ADMIRE-BayesOpt: Accelerated Data MIxture RE-weighting for Language Models with Bayesian Optimization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T20:00:05.206082Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2508.11551"},"observation_digest":"sha256:1b9b81c1973211877266a9e2a59d167ea3ac4cb0e943963da5943f1083d281f5","observation_id":"e2651289-819d-4323-8f74-b7faa459aef5","resolution":{"observed_at":"2026-08-05T20:00:05.206082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-15T17:24:08.165737Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.12680","last_updated":"2025-08-18T07:24:33Z","snapshot_observed_at":"2026-08-18T01:37:24.516846Z","submitted_at":"2025-08-18T07:24:33Z","title":"Vision-G1: Towards General Vision Language Reasoning with Multi-Domain Data Curation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:24:08.165737Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2508.12680"},"observation_digest":"sha256:cf12d8088df5e83f113c9f9d37ba2066767212e383eafeef32ae8d5cc4c542e3","observation_id":"17e8a213-d68d-4a21-b5bd-71b06b1fe91a","resolution":{"observed_at":"2026-08-15T17:24:08.165737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T18:28:49.220498Z","title":"Less: Selecting influential data for targeted instruction tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14648","last_updated":"2025-08-20T11:59:32Z","snapshot_observed_at":"2026-08-16T01:48:49.879363Z","submitted_at":"2025-08-20T11:59:32Z","title":"Understanding Data Influence with Differential Approximation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T18:28:49.220498Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2508.14648"},"observation_digest":"sha256:ddc0610b304a96338e3cf17e4f4f181308f31cb66b7a35197feaf7ff5d7ae762","observation_id":"b10d7fa2-8da9-4dd2-bb51-0fc5e4b821df","resolution":{"observed_at":"2026-08-05T18:28:49.220498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2508.15202","last_updated":"2026-05-04T16:17:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-21T03:31:11Z","title":"Fin-PRM: A Domain-Specialized Process Reward Model for Financial Reasoning in Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-18T22:41:26.047957Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2508.15202"},"observation_digest":"sha256:f01e75989779e2c5f7b9ca0a8fe7ad48081412341d9f28181106c00db6b1731c","observation_id":"a7660945-0e4b-49f6-b351-f168c06c3188","resolution":{"observed_at":"2026-05-18T22:41:52.993698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T17:56:37.005434Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.15475","last_updated":"2025-09-26T09:45:06Z","snapshot_observed_at":"2026-08-20T04:16:57.590911Z","submitted_at":"2025-08-21T11:53:34Z","title":"Influence-driven Curriculum Learning for Pre-training on Limited Data","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-05T17:56:37.005434Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2508.15475"},"observation_digest":"sha256:f9dabd6da0ea7259cdf0cc51b2c0c02fe2cac24e18c61ed2402c61b36a16d70f","observation_id":"d9755a9f-9825-455a-8593-269958c0d50e","resolution":{"observed_at":"2026-08-05T17:56:37.005434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T17:02:40.537745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.17202","last_updated":"2025-08-29T17:46:43Z","snapshot_observed_at":"2026-08-14T11:20:50.387547Z","submitted_at":"2025-08-24T03:34:40Z","title":"Active Domain Knowledge Acquisition with 100-Dollar Budget: Enhancing LLMs via Cost-Efficient, Expert-Involved Interaction in Sensitive Domains","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T17:02:40.537745Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2508.17202"},"observation_digest":"sha256:2bfb3960d2f353d9eec2e1dd4e9b4127eab093fe7b2a67ddb2d7db543dafb0fd","observation_id":"552ae6ce-9406-47c8-b42a-fade4dc9b29b","resolution":{"observed_at":"2026-08-05T17:02:40.537745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-04T11:16:14.978521Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.06048","last_updated":"2026-06-18T04:28:50Z","snapshot_observed_at":"2026-08-17T13:06:47.164819Z","submitted_at":"2025-10-07T15:42:33Z","title":"BLISS: A Lightweight Bilevel Influence Scoring Method for Data Selection in Language Model Pretraining","version":5},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-04T11:16:14.978521Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2510.06048"},"observation_digest":"sha256:2b0c5db059c99cafe0d43827c8fd10f6ae541e20b64e09ba23508c10cb3f00ef","observation_id":"a3b348a0-105a-462f-b5a8-f6b9c5595c07","resolution":{"observed_at":"2026-08-04T11:16:14.978521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2601.20375","last_updated":"2026-05-07T02:38:44Z","snapshot_observed_at":"2026-07-30T12:44:01.703494Z","submitted_at":"2026-01-28T08:37:34Z","title":"LLM-AutoDP: Automatic Data Processing via LLM Agents for Model Fine-tuning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-16T10:54:22.183741Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2601.20375"},"observation_digest":"sha256:0f1867f471982d8baa75be3d2305be7b771e9844383106621228e0df8d4d461a","observation_id":"b3e846b1-8718-4172-9390-914fe4cd7430","resolution":{"observed_at":"2026-05-16T10:57:46.857879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-02T21:05:26.433575Z","title":"Less: Selecting influential data for targeted instruction tuning.ArXiv, abs/2402.04333,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.21492","last_updated":"2026-07-18T04:56:29Z","snapshot_observed_at":"2026-08-13T06:07:51.196283Z","submitted_at":"2026-02-25T01:54:50Z","title":"GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T21:05:26.433575Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2602.21492"},"observation_digest":"sha256:9343ae9ce28acd48babc9b5329222242a45030ba1b5d019cc4ac06e31e386855","observation_id":"fe16efd4-61ae-429c-9b36-2720b842818f","resolution":{"observed_at":"2026-08-02T21:05:26.433575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2604.07769","last_updated":"2026-04-09T03:48:11Z","snapshot_observed_at":"2026-08-15T14:26:40.785504Z","submitted_at":"2026-04-09T03:48:11Z","title":"An Empirical Study on Influence-Based Pretraining Data Selection for Code Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-10T18:13:24.750244Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2604.07769"},"observation_digest":"sha256:3eda4d4c8f3d08a1b683a19696b9651c42c25270adc4d7b8ef2deb0bb66dfee2","observation_id":"87d181e7-8f54-4883-974c-dda1de54edeb","resolution":{"observed_at":"2026-05-11T05:16:04.614363Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2604.08519","last_updated":"2026-04-09T17:55:50Z","snapshot_observed_at":"2026-08-12T23:12:37.728031Z","submitted_at":"2026-04-09T17:55:50Z","title":"Cram Less to Fit More: Training Data Pruning Improves Memorization of Facts","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-05-10T17:42:31.465077Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2604.08519"},"observation_digest":"sha256:0da664ad01706b50aeb7742812561a1d2489ddf4b5e4a6d46b01963a06b87fcb","observation_id":"685f7df8-22e0-422a-88e0-8836ddee743c","resolution":{"observed_at":"2026-05-11T06:15:58.957553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2604.22374","last_updated":"2026-04-24T09:08:45Z","snapshot_observed_at":"2026-08-17T15:11:44.791264Z","submitted_at":"2026-04-24T09:08:45Z","title":"Selective Contrastive Learning For Gloss Free Sign Language Translation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-08T11:42:20.114297Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2604.22374"},"observation_digest":"sha256:395455bc5b9347f4432186ec89c0d251ed725b93db24220b2c6ec02e9f451c38","observation_id":"ccf6d8b0-fb66-49a8-b0c6-0057937bdbc6","resolution":{"observed_at":"2026-05-11T19:31:10.152768Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2605.05508","last_updated":"2026-05-06T23:16:38Z","snapshot_observed_at":"2026-08-13T11:12:37.366063Z","submitted_at":"2026-05-06T23:16:38Z","title":"Rigorous Interpretation Is a Form of Evaluation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-08T15:37:53.477706Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2605.05508"},"observation_digest":"sha256:af453a8b19fb10a00d026c0999d0a28e40771dca5adbcbd0f7c1f818c205b5b0","observation_id":"6c9d08b1-8c79-44eb-b94f-c6155e29257f","resolution":{"observed_at":"2026-05-11T18:31:13.532088Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2605.09404","last_updated":"2026-05-10T08:07:09Z","snapshot_observed_at":"2026-08-12T14:56:54.130771Z","submitted_at":"2026-05-10T08:07:09Z","title":"Let the Target Select for Itself: Data Selection via Target-Aligned Paths","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-12T02:47:55.649231Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2605.09404"},"observation_digest":"sha256:3df777e008d37da60565b25b1207aa46603bab67d0061eb3e174f597914b7129","observation_id":"b0c16eca-6102-4996-a681-820d1221266b","resolution":{"observed_at":"2026-05-12T02:51:17.987635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2605.12681","last_updated":"2026-05-12T19:32:08Z","snapshot_observed_at":"2026-08-17T00:48:20.819551Z","submitted_at":"2026-05-12T19:32:08Z","title":"Toward Communication-Efficient Space Data Centers: Bottlenecks, Architectures, and New Paradigms","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T19:50:51.545684Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2605.12681"},"observation_digest":"sha256:5186c2000b77cbe7958ba1677918b42013f78a344c99bafdfb399449fe636b07","observation_id":"c5d4e810-3b1f-4dd4-aefc-94145e55996d","resolution":{"observed_at":"2026-05-14T19:52:52.481222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2605.12906","last_updated":"2026-05-25T14:11:40Z","snapshot_observed_at":"2026-08-12T12:16:35.785011Z","submitted_at":"2026-05-13T02:33:04Z","title":"Data Difficulty and the Generalization--Extrapolation Tradeoff in LLM Fine-Tuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-14T20:02:58.318276Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2605.12906"},"observation_digest":"sha256:37fc1aed96adb42f437e87e263bec6be4c76fa8c51e35d503ede71747e2a224c","observation_id":"c15f55db-b6e3-465c-a7e3-d176f638882d","resolution":{"observed_at":"2026-05-14T20:07:54.541665Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2605.21422","last_updated":"2026-06-01T04:58:51Z","snapshot_observed_at":"2026-08-15T13:16:35.532686Z","submitted_at":"2026-05-20T17:15:43Z","title":"PRISM: Preference-Aware Influence Function Based Data Selection Method for Efficient Fine-Tuning","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T17:01:21.521025Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2605.21422"},"observation_digest":"sha256:a4961ad98c4f9212e03e3a4df7831a35776e4b05d5c9244c2bd60497bbb4c817","observation_id":"38050bd9-b388-4dfa-a9ab-b90a733208bb","resolution":{"observed_at":"2026-06-30T17:04:56.612576Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2605.22389","last_updated":"2026-05-21T12:21:41Z","snapshot_observed_at":"2026-08-17T20:55:43.998226Z","submitted_at":"2026-05-21T12:21:41Z","title":"Unified Data Selection for LLM Reasoning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-22T05:33:20.930156Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2605.22389"},"observation_digest":"sha256:577e5a49e2abb8c0feba23b06db314e7ed6567b3f1467db8039dbcb437fd118a","observation_id":"fffa1b45-079a-4bab-a7b5-6f7eec05379c","resolution":{"observed_at":"2026-05-22T05:34:40.117198Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2605.23969","last_updated":"2026-05-13T06:36:24Z","snapshot_observed_at":"2026-08-09T04:48:40.503387Z","submitted_at":"2026-05-13T06:36:24Z","title":"SLAP: Stratified Loss-based Pruning for On-Policy Data-Efficient Instruction Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T22:02:30.217607Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2605.23969"},"observation_digest":"sha256:4f69cd65a7bc7b26fd20bfb2bccc4e2758c449abf40e25b2aae56f13b35ba84f","observation_id":"22045372-c9d9-46be-8336-63469e73ee5b","resolution":{"observed_at":"2026-06-30T22:05:05.687911Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2605.28631","last_updated":"2026-05-27T15:38:09Z","snapshot_observed_at":"2026-08-16T21:35:12.845485Z","submitted_at":"2026-05-27T15:38:09Z","title":"Single-Rollout Hidden-State Dynamics for Training-Free RLVR Data Selection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T14:08:40.968105Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2605.28631"},"observation_digest":"sha256:1205862f6c1d5c3c94654511318dcef3c6ad8b4c93eca251309d0bff3b229152","observation_id":"81ebf038-a562-469c-92a9-ba547a2ec863","resolution":{"observed_at":"2026-06-29T14:13:30.072550Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2606.18286","last_updated":"2026-06-10T04:46:04Z","snapshot_observed_at":"2026-08-16T09:24:25.859983Z","submitted_at":"2026-06-10T04:46:04Z","title":"CODEBLOCK: Learning to Supervise Code at the Right Granularity","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T10:52:00.147391Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2606.18286"},"observation_digest":"sha256:bd0100845617d070d84c1bcd6f24fa2f1f10a560e6caba6e2ca3ccb6aa9336c8","observation_id":"b05c5d5a-316f-4ef5-af46-570b1d7322c6","resolution":{"observed_at":"2026-07-03T08:17:45.517082Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2606.18307","last_updated":"2026-06-16T07:21:49Z","snapshot_observed_at":"2026-07-06T23:53:45.117607Z","submitted_at":"2026-06-16T07:21:49Z","title":"DRIFT: Refining Instruction Data via On-Policy Data Attribution","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T01:57:05.784589Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2606.18307"},"observation_digest":"sha256:0402bdf181efeb6984b0f606e76dd559f84049cc9002d0aacaed82812aa40ee9","observation_id":"72067d73-c7bb-4b23-a19e-e6d195fa543c","resolution":{"observed_at":"2026-07-03T19:18:54.743967Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2606.19549","last_updated":"2026-06-17T19:40:51Z","snapshot_observed_at":"2026-08-20T11:38:15.477381Z","submitted_at":"2026-06-17T19:40:51Z","title":"Predicting Mergeability of Parameter-Efficient Fine-Tuning Updates","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-06-26T21:01:04.043286Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2606.19549"},"observation_digest":"sha256:128cbc7f506a4f9b6d77ce13d50f113b357a953ef75f32fec47f099a97a5f382","observation_id":"42197a11-2828-4ea1-836a-5fc49503a4cc","resolution":{"observed_at":"2026-07-04T00:49:17.660072Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2606.23591","last_updated":"2026-06-22T17:00:04Z","snapshot_observed_at":"2026-08-16T03:31:08.842158Z","submitted_at":"2026-06-22T17:00:04Z","title":"Quantifying the Agreement Between Data-Influence and Data-Similarity to Understand LLM Behavior","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-06-26T08:45:34.884703Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2606.23591"},"observation_digest":"sha256:5db680e5c3cabbb0ce0cc3cdd1c8db302439042e90aa0ca7ba0abd87a256f49a","observation_id":"1b4ce2c7-c125-45c1-b9ff-5a310395af18","resolution":{"observed_at":"2026-06-26T08:49:14.974070Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2606.23611","last_updated":"2026-06-22T17:11:15Z","snapshot_observed_at":"2026-08-12T13:39:08.360008Z","submitted_at":"2026-06-22T17:11:15Z","title":"Data Selection Through Iterative Self-Filtering for Vision-Language Settings","version":1},"reference_index":197,"source":"arxiv_source","source_observed_at":"2026-06-26T09:22:47.537137Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2606.23611"},"observation_digest":"sha256:d8bdbd3d4db22a1e2d28a2a325e5d815591fc00b563ceb575c917412adecceb6","observation_id":"5d0dc1af-7531-4af3-bd5a-db33d86d8c9a","resolution":{"observed_at":"2026-07-04T09:49:44.950900Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2606.25178","last_updated":"2026-06-27T02:34:55Z","snapshot_observed_at":"2026-08-14T23:27:30.054684Z","submitted_at":"2026-06-23T21:10:29Z","title":"Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-25T22:47:09.330723Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2606.25178"},"observation_digest":"sha256:2f34fc9603eafe70a57cf03819508fb02569d938d52aab7330969202ba148644","observation_id":"f5187601-fab7-4ef1-8fca-a6d3cd15ade9","resolution":{"observed_at":"2026-07-04T18:30:01.570899Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2606.25178","last_updated":"2026-06-27T02:34:55Z","snapshot_observed_at":"2026-08-14T23:27:30.054684Z","submitted_at":"2026-06-23T21:10:29Z","title":"Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-30T09:55:19.804589Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2606.25178"},"observation_digest":"sha256:2c18120118b33eb5571c7d39b731b072ecd82574bdba88c46ed029a66b4a3ffc","observation_id":"9ba4dd02-1047-4f55-a843-acde45ce4f63","resolution":{"observed_at":"2026-06-30T12:54:40.437339Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2606.26091","last_updated":"2026-06-24T17:59:02Z","snapshot_observed_at":"2026-08-10T18:32:18.583804Z","submitted_at":"2026-06-24T17:59:02Z","title":"On-Policy Self-Distillation with Sampled Demonstrations Reduces Output Diversity","version":1},"reference_index":218,"source":"arxiv_source","source_observed_at":"2026-06-25T19:23:56.452083Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2606.26091"},"observation_digest":"sha256:873b196b2b59b60f11e31ba29e67b4d1f4623638702b7b0d8af4bf7c1510e49e","observation_id":"45c43e9a-76f2-40d8-a7e7-3e39de747679","resolution":{"observed_at":"2026-07-04T20:50:12.684409Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2607.01727","last_updated":"2026-07-02T05:31:36Z","snapshot_observed_at":"2026-08-13T14:59:23.770307Z","submitted_at":"2026-07-02T05:31:36Z","title":"When Does Generating More Help? Disentangling Fixed-Source Synthesis from Source Expansion in Synthetic Data Scaling","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-03T15:20:51.474398Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.01727"},"observation_digest":"sha256:2ba0b812170dc488e741286d42d2f407bbf27941366a34ed058dc11a20d9a8b8","observation_id":"babf0a09-e7f6-4dea-828d-665ffdb55bc4","resolution":{"observed_at":"2026-07-03T15:28:33.802412Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":"2402.04333","doi":"10.48550/arxiv.2402.04333","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Less: Selecting influential data for targeted instruction tuning","venue":"arXiv (Cornell University)","work_id":"74caee8c-a05c-4b22-ab43-b144f71fcf6d","year":2024},"citing_paper":{"arxiv_id":"2607.02266","last_updated":"2026-07-02T14:51:42Z","snapshot_observed_at":"2026-08-08T15:31:37.930459Z","submitted_at":"2026-07-02T14:51:42Z","title":"HERMES: A Multi-Granularity Labeling Substrate for Pre-training Data Mixtures","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-07-03T16:44:41.720388Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.02266"},"observation_digest":"sha256:325cebf3a939f4a333eb14b7846f92253ec0e11673084ad9199fa794e2b7af63","observation_id":"6f1c2684-6d63-4df4-a498-b5b16a5118cb","resolution":{"observed_at":"2026-07-03T16:48:39.404908Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-02T00:17:36.191807Z","title":"Mengzhou Xia, Sadhika Malladi, Suchin Gururangan, Sanjeev Arora, and Danqi Chen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15081","last_updated":"2026-07-16T14:51:42Z","snapshot_observed_at":"2026-08-19T03:00:36.494628Z","submitted_at":"2026-07-16T14:51:42Z","title":"DataShield: Uncovering Risky Fine-Tuning Data Across LLMs Through Consensus Subspace Alignment","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T00:17:36.191807Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.15081"},"observation_digest":"sha256:a6c38ef593a02c0575e16a37dac22de8e87c26ac15ec7f1ae6ee4e905fde7054","observation_id":"65992ae1-e984-42f8-b12b-e0c037d7dcc9","resolution":{"observed_at":"2026-08-02T00:17:36.191807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-02T13:43:29.432403Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20465","last_updated":"2026-05-19T02:23:53Z","snapshot_observed_at":"2026-08-16T17:03:04.481404Z","submitted_at":"2026-05-19T02:23:53Z","title":"DataPrep-Bench: Benchmarking LLMs as Training Data Preparators","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:29.432403Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.20465"},"observation_digest":"sha256:2587839d02d3b95bc20c3264ba6b6cd453f55172065a00bd69ff7395eba02879","observation_id":"d3d50ac5-3475-4a71-a7fc-109dec7d815d","resolution":{"observed_at":"2026-08-02T13:43:29.432403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-01T06:19:33.174874Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22769","last_updated":"2026-07-24T03:54:58Z","snapshot_observed_at":"2026-08-16T07:38:14.022663Z","submitted_at":"2026-07-24T03:54:58Z","title":"DomainPilot: Domain-Level Loss-Guided Two-Stage Data Mixture Optimization for Efficient Language Model Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T06:19:33.174874Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.22769"},"observation_digest":"sha256:a49a97f7101f4170356fd8f01c8f1dfb0f23fa6b4e163ea7b9909dacecf4bbd5","observation_id":"c2c8288b-7575-47fa-8bed-2d1642d7603f","resolution":{"observed_at":"2026-08-01T06:19:33.174874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-07-31T00:30:21.553602Z","title":"Less: Selecting influential data for targeted instruction tuning.arXiv preprint arXiv:2402.04333,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25136","last_updated":"2026-07-27T23:05:12Z","snapshot_observed_at":"2026-08-16T02:33:17.817541Z","submitted_at":"2026-07-27T23:05:12Z","title":"Less Data, Better Alignment: Data-Centric Multi-Evaluator Agreement for Preference Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T00:30:21.553602Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.25136"},"observation_digest":"sha256:c6d6fe49d5dd9f33b0fe09bf1026f123f75eb138f6d79b0dd6f09967a8de4501","observation_id":"35f2a815-325f-4514-b402-e323b95f7b8a","resolution":{"observed_at":"2026-07-31T00:30:21.553602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-01T03:02:08.841217Z","title":"doi:10.48550/arXiv.2402.04333 , abstract =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25271","last_updated":"2026-07-28T04:18:49Z","snapshot_observed_at":"2026-08-13T02:12:02.677620Z","submitted_at":"2026-07-28T04:18:49Z","title":"Bridging Compute- and Data-Optimal Pretraining","version":1},"reference_index":180,"source":"arxiv_source","source_observed_at":"2026-08-01T03:02:08.841217Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.25271"},"observation_digest":"sha256:3fb8d27d03f5448add8a8826ad8edf59e44ff78a5bfee6a97a242facf5ff856a","observation_id":"be57078a-a0bc-4538-a878-545a405a753d","resolution":{"observed_at":"2026-08-01T03:02:08.841217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-01T01:15:07.235536Z","title":"2402.04333 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25886","last_updated":"2026-07-28T15:46:41Z","snapshot_observed_at":"2026-08-15T15:47:26.100019Z","submitted_at":"2026-07-28T15:46:41Z","title":"RSIBench-Data: Benchmarking Data-Centric Research for Recursive Self-Improvement","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T01:15:07.235536Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.25886"},"observation_digest":"sha256:35b6befcb05a598613a198430c3b0c859a44426d40bfc4bb150c597b31da6c5b","observation_id":"02092546-02ad-403a-b3fe-a213b719dbbe","resolution":{"observed_at":"2026-08-01T01:15:07.235536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-01T10:52:18.942456Z","title":"arXiv preprint arXiv:2402.04333 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.27273","last_updated":"2026-07-29T12:17:18Z","snapshot_observed_at":"2026-08-04T11:34:03.347670Z","submitted_at":"2026-07-29T12:17:18Z","title":"SDO: Structure-Aware Data Organization for Efficient LLM Post-Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T10:52:18.942456Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2607.27273"},"observation_digest":"sha256:fe471112344230364afec429c679a0394da3976b775613ed40cf2073534fe728","observation_id":"ae92028b-9090-43f1-b779-6ca9cca80a4b","resolution":{"observed_at":"2026-08-01T10:52:18.942456Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-04T01:29:18.422598Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00068","last_updated":"2026-07-29T06:02:01Z","snapshot_observed_at":"2026-08-14T13:12:12.884893Z","submitted_at":"2026-07-29T06:02:01Z","title":"SafeBuild-Bench: A Temporal-Robust Construction Safety Benchmark with Graph-Enhanced Data Mining","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T01:29:18.422598Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2608.00068"},"observation_digest":"sha256:7a07bd9ecbbf7cdffbbda1504bc2a5f10fa478b76ff72863a31fe62a98de6977","observation_id":"fc11e768-8335-42cf-b92d-6c6c9617c245","resolution":{"observed_at":"2026-08-04T01:29:18.422598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-11T00:27:49.959430Z","title":"arXiv preprint arXiv:2402.04333 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07719","last_updated":"2026-08-07T19:11:54Z","snapshot_observed_at":"2026-08-15T22:51:26.561863Z","submitted_at":"2026-08-07T19:11:54Z","title":"CODS: Iterative Bellman-Residual Data Selection for Reusable Offline Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T00:27:49.959430Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2608.07719"},"observation_digest":"sha256:74cf7d1ef9c67a44e052f1d2db8588305502f657d68ea40ee060f57e4e121ba6","observation_id":"8bffff43-b5e4-40cb-996b-9ea6ae5014aa","resolution":{"observed_at":"2026-08-11T00:27:49.959430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-14T04:32:12.534998Z","title":"LESS: Selecting influential data for targeted instruction tuning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.13545","last_updated":"2026-08-13T17:56:12Z","snapshot_observed_at":"2026-08-17T23:53:20.073266Z","submitted_at":"2026-08-13T17:56:12Z","title":"LittleLearner: Language Models Under Pedagogically Controlled Knowledge Exposure","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:32:12.534998Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2608.13545"},"observation_digest":"sha256:23605a82dd3e7c989a3a3d2120250f062b83ee0b8e4b7f292b18bb4e1e22170d","observation_id":"0e714bce-1beb-405e-8ec6-dd1145f17663","resolution":{"observed_at":"2026-08-14T04:32:12.534998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.04333/citation-record","integrity":"/paper/2402.04333/integrity","json":"/paper/2402.04333/citation-record.json","paper":"/paper/2402.04333"},"outbound":[],"paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T14:20:52.583862Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 80 inbound Pith citation observations for arXiv:2402.04333."}