{"as_of":"2026-08-07T19:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:105717ef1adfa69f488b84a454d3b54e728ba8c583822c67bfa5de0ad0bb2798","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T14:13:54.748258Z","state":"measured"},{"denominator":89,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":89,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.21589/citation-record","integrity":"/paper/2508.21589/integrity","json":"/paper/2508.21589/citation-record.json","paper":"/paper/2508.21589"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T14:13:46.793312Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:46.793312Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:63c3ac69d5a5595d22db952e389ade80434b457b279df1d66c83385e5fe064b2","observation_id":"a8017fb1-2e1d-4132-ab12-07fe79c50313","resolution":{"observed_at":"2026-08-05T14:13:46.793312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:46.866463Z","title":"Program synthesis with large language models,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:46.866463Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:e9f74c53256791fa0d1521500e71e572cb8faa43c13492b48c880b0b14caefdb","observation_id":"64ff19d5-9f0c-40a0-8ddb-371d637b9fd8","resolution":{"observed_at":"2026-08-05T14:13:46.866463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:47.017342Z","title":"Synthetic and natural noise both break neural machine translation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.017342Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:5fa899d224d10bd2c0fcefdbfe61aee53fd80c6ea263d158b45654215be35d56","observation_id":"c6383f34-fcd3-4d72-9c85-f04d6f6fc320","resolution":{"observed_at":"2026-08-05T14:13:47.017342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:47.116173Z","title":"Instruction mining: Instruction data selection for tuning large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.116173Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:c1877dac913db759620af58645b43ed157259bea39efb45cd7da9dcc3432713f","observation_id":"af64a94e-a360-448e-a6c1-55273f529e57","resolution":{"observed_at":"2026-08-05T14:13:47.116173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:47.207582Z","title":"Alpagasus: Training a better alpaca with fewer data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.207582Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:ea72de6516efb15dbea287c2ff2909a15a811a5f39e57cf871bd56335b09b462","observation_id":"b3b8393b-eb29-444f-b888-4919a9913804","resolution":{"observed_at":"2026-08-05T14:13:47.207582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T14:13:47.284604Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.284604Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:7612d660c628a791f38b42d4bb1f5040223120a3c384a54a8615df56828f5e46","observation_id":"1def5ba4-21d2-498e-b98b-14c5c13ec6c3","resolution":{"observed_at":"2026-08-05T14:13:47.284604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-05T14:13:47.367001Z","title":"Training verifiers to solve math word problems, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.367001Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:776306c8437c37deb5c6391a1818c79281786edd88dd9ba1dbbe3468271bca10","observation_id":"dcb52a8a-fa5f-4e88-82ec-173db342e596","resolution":{"observed_at":"2026-08-05T14:13:47.367001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03883","last_updated":"2024-03-07T06:39:32Z","snapshot_observed_at":"2026-07-06T17:40:33.769700Z","submitted_at":"2024-03-06T17:42:16Z","title":"SaulLM-7B: A pioneering Large Language Model for Law","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03883","snapshot_observed_at":"2026-08-05T14:13:47.448387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.448387Z"},"links":{"cited_paper":"/paper/2403.03883","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:829a09807cde8c856d38122b1414fc3c9d61095dc7667d0c2c98d80c94cf943d","observation_id":"2ce42f07-e046-49af-b740-a91ab8df5261","resolution":{"observed_at":"2026-08-05T14:13:47.448387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:47.533785Z","title":"Opencompass: A universal evaluation platform for foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.533785Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:3a9211b40877ccf01633bfcdd855a8e455147e6c657768b28a417498f0e676ab","observation_id":"384017c0-a832-4694-be9e-4bf8ba239154","resolution":{"observed_at":"2026-08-05T14:13:47.533785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:47.583018Z","title":"Auggpt: Leveraging chatgpt for text data augmentation.IEEE Transactions on Big Data, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.583018Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:3e2ff6fc26070d9f1be41c081dd711e09a29591fb2bd5881664de5b4b772cb4c","observation_id":"5e43cc12-4ca4-400e-aa0d-7b6273ca274b","resolution":{"observed_at":"2026-08-05T14:13:47.583018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15653","last_updated":"2023-11-27T09:33:13Z","snapshot_observed_at":"2026-07-06T16:52:57.823137Z","submitted_at":"2023-11-27T09:33:13Z","title":"MoDS: Model-oriented Data Selection for Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15653","snapshot_observed_at":"2026-08-05T14:13:47.664410Z","title":"Mods: Model-oriented data selection for instruction tuning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.664410Z"},"links":{"cited_paper":"/paper/2311.15653","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:9dfcdea4dc4fa7eed7eec7db243a55ad26d40c1084dbde82cdfe74e22f547ca7","observation_id":"800f6515-9b60-4c4a-8258-06dbde6f080b","resolution":{"observed_at":"2026-08-05T14:13:47.664410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T14:13:47.749652Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.749652Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:7d99067c208f80ee4cd3e413607ff2c00a33b4d5e14ddb53a0fcbe3b3be6e9e4","observation_id":"89175dfa-d8f6-479c-af89-7dc6290407db","resolution":{"observed_at":"2026-08-05T14:13:47.749652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:47.821387Z","title":"Understanding back-translation at scale","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.821387Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:c87031d3333c13210be0dad857553aab2d6a46a6a593c9adb63940c01e1d3fed","observation_id":"41748293-7e56-485e-b8f8-4fcf640998d9","resolution":{"observed_at":"2026-08-05T14:13:47.821387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:47.864522Z","title":"A strategic coordination framework of small LMs matches large LMs in data synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.864522Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:f5091c8624bc330c2c34e78a073b5bfc290635dcaaa99387a8f0b29c8f895545","observation_id":"a5552cad-7d48-452f-9d25-c8f900ad7101","resolution":{"observed_at":"2026-08-05T14:13:47.864522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02980","last_updated":"2024-12-09T22:23:41Z","snapshot_observed_at":"2026-07-06T20:01:19.215540Z","submitted_at":"2024-12-04T02:47:45Z","title":"Surveying the Effects of Quality, Diversity, and Complexity in Synthetic Data From Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.02980","snapshot_observed_at":"2026-08-05T14:13:47.911651Z","title":"Surveying the effects of quality, diversity, and complexity in synthetic data from large language models.arXiv preprint arXiv:2412.02980, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.911651Z"},"links":{"cited_paper":"/paper/2412.02980","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:5ba6736394e3dfa1b5314694eabe2217d4a6ece655b2033baef467442419b28c","observation_id":"42cfd222-065e-48ae-a358-ca2839290159","resolution":{"observed_at":"2026-08-05T14:13:47.911651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:47.966569Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:47.966569Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:c32d5f34a3f51ed152302f0a8ccacc47db27271a06dcb6e153abcbc75a5aa911","observation_id":"66d70165-4ae3-4242-ab6a-e7a312f8e7be","resolution":{"observed_at":"2026-08-05T14:13:47.966569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:06.518140Z","title":"Measuring mathematical problem solving with the MATH dataset","venue":null,"work_id":"96086685-2773-4852-b700-01a8460e879a","year":2021},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.182530Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:d923eba2a28b15aced88d2ffdcb80db622bde58df7bd49e306faa59883de60c6","observation_id":"b43fa31d-8d15-4189-bc7c-bc6fd2e183b0","resolution":{"observed_at":"2026-08-05T14:14:06.600924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:48.068514Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.068514Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:bcb3be86e4458eb28b73adfa97527d53f1c5558461e921b068fd138a6b115ef2","observation_id":"230e95de-d656-4f08-be23-1fc3692e095a","resolution":{"observed_at":"2026-08-05T14:13:48.068514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17365","last_updated":"2024-12-23T08:01:24Z","snapshot_observed_at":"2026-08-04T08:36:59.099227Z","submitted_at":"2024-12-23T08:01:24Z","title":"Boosting LLM via Learning from Data Iteratively and Selectively","version":1},"cited_work":{"arxiv_id":"2412.17365","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.17365","snapshot_observed_at":"2026-08-05T14:13:55.156116Z","title":"Boosting LLM via Learning from Data Iteratively and Selectively","venue":"cs.CL","work_id":"d6ac58d1-4867-47bc-8e85-b764810cdd3b","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.299054Z"},"links":{"cited_paper":"/paper/2412.17365","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:07e9b8fb86e947461d229f62046142c8033b87c4405f83fcd05a34c304f11016","observation_id":"661e6b99-0dc0-42b8-a46d-46840bce793d","resolution":{"observed_at":"2026-08-05T14:13:55.210427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T14:13:48.242937Z","title":"Gpt-4o system card.arXiv preprint arXiv:2410.21276, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.242937Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:33250afcfabab943b7d0131da8f1cf6ace0e4db887fa58ce24f310f09a85a0f7","observation_id":"d00aa0ce-d1f0-4bfa-bea4-7c5b645f2a0d","resolution":{"observed_at":"2026-08-05T14:13:48.242937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:06.351871Z","title":"Impossible distillation for paraphrasing and summarization: How to make high-quality lemonade out of small, low-quality model","venue":null,"work_id":"d1c2b816-36ec-47b8-81a3-22734c8131a6","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.512565Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:5a666a0533c9d6ec18aea796e4d60cf6bd328751c023f5e5a63aa91417ef7592","observation_id":"f054bbfd-2e46-47b5-858a-5571db4fd082","resolution":{"observed_at":"2026-08-05T14:14:06.440813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T14:13:48.399345Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.399345Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:517c1dd65058a0cb34c639f2e59e1897b73c0a7efde0cd4c9de11e3e11da0208","observation_id":"0b958245-96b9-4969-8389-c43b6b7bdea9","resolution":{"observed_at":"2026-08-05T14:13:48.399345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:06.052313Z","title":"Active instruction tuning: Improving cross-task generalization by training on prompt sensitive tasks","venue":null,"work_id":"31ed091a-9854-429b-8f8e-fbf395dfa0bb","year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.664702Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:f355854de29c521a66c114486122ef9fab4ede1df1cc6d9e6ce53e748652ec4c","observation_id":"5c72a8e7-2800-4c9a-aa04-2a104998d580","resolution":{"observed_at":"2026-08-05T14:14:06.107922Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:06.211034Z","title":"Dataenvgym: Data generation agents in teacher environments with student feedback","venue":null,"work_id":"9956f59a-aed6-4812-92e5-4b6ee30064f0","year":2025},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.607148Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:b083825f1dbe027c4de6f2cd88fa8cfdf747ee4d10a501d709837cfbcad0f952","observation_id":"c54fe1ad-cf5f-47cc-b047-52d42c693555","resolution":{"observed_at":"2026-08-05T14:14:06.267613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:05.774761Z","title":"The bigscience roots corpus: A 1.6 tb composite multilingual dataset.Advances in Neural Information Processing Systems, 35:31809–31826, 2022","venue":null,"work_id":"3d84e679-c38f-4e74-a6b4-21f2f6c7205d","year":2022},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.826800Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:d3f6cc729bd4985540205518bd269abe6abccd20ef3f4bbc42d3dd0a1fef130e","observation_id":"f6682ea1-aa09-45b3-889d-87850e06c9dc","resolution":{"observed_at":"2026-08-05T14:14:05.857017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:05.924569Z","title":"Efficient memory management for large language model serving with pagedattention","venue":null,"work_id":"a6cd5c0d-4d36-4729-b1cf-57cad6595b98","year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.754424Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:b1a952a0eae2c14a80a82457782ddff2a515ccea2d05ff2e248d5c8573901baa","observation_id":"e90b2eb8-0286-4a9e-8d6b-12c1f020028e","resolution":{"observed_at":"2026-08-05T14:14:05.963328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:05.556410Z","title":"Synthetic data (almost) from scratch: Generalized instruction tuning for language models.Transactions on Machine Learning Research, 2025","venue":null,"work_id":"9fe15ba3-5ff4-44ad-b010-a706ce3db853","year":2025},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:49.045299Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:2f4d4b55acd5473003755ecc639d36bfd0a9423d0c20255a9337ac1a3566e271","observation_id":"b938a869-865a-480a-8b8a-a71e99dd5731","resolution":{"observed_at":"2026-08-05T14:14:05.601281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:05.653826Z","title":"Llm2llm: Boosting llms with novel iterative data enhancement","venue":null,"work_id":"0d3f3c6e-61f7-40f4-94ac-6c8450de460e","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:48.931903Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:d14a66acaa1e37077f9a4f0822a6c7c39d53fa6bba4d1f8ee55b49823ba3d4aa","observation_id":"c4d1719e-d22e-4e65-b885-8ed177f60b69","resolution":{"observed_at":"2026-08-05T14:14:05.714925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:04.897653Z","title":"Superfiltering: Weak-to-strong data filtering for fast instruction-tuning","venue":null,"work_id":"40a2f0a0-c257-463b-9796-4863706d320f","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:49.403061Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:02a71ba21311c98ae72bf7974de1831eb6e2a6137f4ed05d24f8295857c78af5","observation_id":"1718c927-0095-4271-8215-a1ea598ececc","resolution":{"observed_at":"2026-08-05T14:14:05.101996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:05.223920Z","title":"Selective reflection-tuning: Student-selected data recycling for llm instruction-tuning","venue":null,"work_id":"5b07a7eb-6925-4d0c-bd95-7a9f197349ab","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:49.199051Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:f7d6f5067022e720925f77bd4a4c52d48fa15a88cccfcff73a6877428eacecf4","observation_id":"0c284da9-b396-4e47-a75a-57e6f371b31e","resolution":{"observed_at":"2026-08-05T14:14:05.327382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:04.522965Z","title":"Self-alignment with instruction backtranslation","venue":null,"work_id":"7c0b6c3a-7301-4152-9195-d4ea5bc5af7b","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:49.756708Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:a71a7105e104d7eb85a92ca5c59d7e788a7f673b6b18d55403cdcc4da59dfb3b","observation_id":"c2b5f4ad-4a6e-4e70-a8cb-d44e49e79eb6","resolution":{"observed_at":"2026-08-05T14:14:04.726946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:49.560557Z","title":"From quantity to quality: Boosting llm performance with self-guided data selection for instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:49.560557Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:445fc303a20d81de0c500e9313f23c64d7a45e3d4548a0bebf26a7be6fdce99e","observation_id":"b2661dd3-1fb3-4ae8-99cb-ae95243a7bf5","resolution":{"observed_at":"2026-08-05T14:13:49.560557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03663","last_updated":"2025-05-20T05:00:01Z","snapshot_observed_at":"2026-07-06T19:27:52.298292Z","submitted_at":"2024-10-04T17:59:41Z","title":"Learning from Committee: Reasoning Distillation from a Mixture of Teachers with Peer-Review","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03663","snapshot_observed_at":"2026-08-05T14:13:50.018824Z","title":"Learning from committee: Reasoning distillation from a mixture of teachers with peer-review, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.018824Z"},"links":{"cited_paper":"/paper/2410.03663","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:081186ae8ef8a990a7cbe336f89eedb0a3793802152424e34f41b064a0c0cd99","observation_id":"c98e8f2c-e32d-4a33-83f8-ebf3cbdff3a2","resolution":{"observed_at":"2026-08-05T14:13:50.018824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:04.094591Z","title":"One-shot learning as instruction data prospector for large language models","venue":null,"work_id":"1a2825c5-6caa-4577-8820-e9613279999c","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:49.907875Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:d2920b78e902872f7582e0a1052c959cf0f4e42e129d97c814b4a1c7b4c52ee4","observation_id":"9da0ba7f-914f-4218-af2d-51ff06f8fe53","resolution":{"observed_at":"2026-08-05T14:14:04.336612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:02.678344Z","title":null,"venue":null,"work_id":"97ddc243-ccfb-4dcf-9d49-1c90501c887b","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.230197Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:bbf8b87bcdde7008084d36c467477c23f2485b7b4792f5f1a7d1a6113f94661a","observation_id":"f5960387-a6c2-4207-bd59-16072deec14f","resolution":{"observed_at":"2026-08-05T14:14:03.070826Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:03.525181Z","title":"I-SHEEP: Self-alignment of LLM from scratch through an iterative self-enhancement paradigm","venue":null,"work_id":"d2c3e24b-115f-4f92-b705-6903414dc225","year":2025},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.101882Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:b54a1fdc219d323eda7ae8b3538be1b832d802af7fe5cdcc7696829f2e00a53b","observation_id":"96352ac5-8f70-4b77-80fc-b898d7e75b96","resolution":{"observed_at":"2026-08-05T14:14:03.834861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:02.213379Z","title":"Alignbench: Benchmarking chinese alignment of large language models","venue":null,"work_id":"37e3b8fe-e1db-47f2-bc30-aad415e9dc37","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.404799Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:11bc638388a4b900075fc5a8b7c6aef625748ace7056a6056da223144d8380f0","observation_id":"108ab5c8-8261-45f7-b84c-224be0ad27e3","resolution":{"observed_at":"2026-08-05T14:14:02.408046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:50.325380Z","title":"What makes good data for alignment? a comprehensive study of automatic data selection in instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.325380Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:081d9728a291f707369f8f3ee03c849975aa3dd1e393e43206e6ac7781d62a35","observation_id":"a9bb512b-e2f8-4e4c-ba38-b83c78d145e0","resolution":{"observed_at":"2026-08-05T14:13:50.325380Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:01.690745Z","title":"Condor: Enhance llm alignment with knowledge-driven data synthesis and refinement","venue":null,"work_id":"aa1031bf-654b-4944-a049-6b5366edf8c5","year":2025},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.593498Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:2098aa039d13611444c57b63b84abcfaa1177ff4ec4e8723b2eadeacb15cd8ff","observation_id":"88500d71-ebd7-4223-a085-98d6c3f1d0e4","resolution":{"observed_at":"2026-08-05T14:14:01.993664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:50.477985Z","title":"#instag: Instruction tagging for analyzing supervised fine-tuning of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.477985Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:cd2ba6ef36f63da2b9bbe87f0b3338693e9df4a7b591430a12020b617ace4ebd","observation_id":"2089b88d-7023-49d2-ba72-70cac8f31373","resolution":{"observed_at":"2026-08-05T14:13:50.477985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13467","last_updated":"2025-05-30T17:53:07Z","snapshot_observed_at":"2026-07-06T19:05:22.642274Z","submitted_at":"2024-08-24T05:03:08Z","title":"LlamaDuo: LLMOps Pipeline for Seamless Migration from Service LLMs to Small-Scale Local LLMs","version":3},"cited_work":{"arxiv_id":"2408.13467","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.13467","snapshot_observed_at":"2026-08-05T14:13:54.904954Z","title":"LlamaDuo: LLMOps Pipeline for Seamless Migration from Service LLMs to Small-Scale Local LLMs","venue":"cs.LG","work_id":"b4cc03aa-59ab-4df1-a298-1faf98b68c3c","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.767433Z"},"links":{"cited_paper":"/paper/2408.13467","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:1f7410da259d6543b28c45c9aa10faf9cf9e91c4f8bc0ea1db9ddc15bbc3dad4","observation_id":"c08811b7-2b65-48b0-ae42-58310340e4bf","resolution":{"observed_at":"2026-08-05T14:13:54.979012Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02707","last_updated":"2023-06-05T08:58:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-05T08:58:39Z","title":"Orca: Progressive Learning from Complex Explanation Traces of GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02707","snapshot_observed_at":"2026-08-05T14:13:50.674721Z","title":"Orca: Progressive learning from complex explanation traces of gpt-4, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.674721Z"},"links":{"cited_paper":"/paper/2306.02707","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:9e1983f2d4352887b3415d372bbfdd68ab19393661d1b315cf7307b641d1422f","observation_id":"a0c0c67a-eae7-4cd3-b40e-23bd757753c7","resolution":{"observed_at":"2026-08-05T14:13:50.674721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-05T14:13:50.941654Z","title":"Instruction tuning with gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.941654Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:658eb06ac65ea68a2be1d8fb8684295d0cb4fa800b9c75fe98bbae555d66289f","observation_id":"5f10db38-41a3-4204-8093-386f8e7300de","resolution":{"observed_at":"2026-08-05T14:13:50.941654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:01.323623Z","title":"Datadreamer: A tool for synthetic data generation and reproducible llm workflows","venue":null,"work_id":"432c476e-4e0c-4934-a96e-570f5ec73168","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:50.827673Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:d2d37ccf9b54a9fe1e05ccfcbb17c9f661419240885ce88bf8368fee5921fbec","observation_id":"c9d1c56b-416c-4da3-aa8a-7522a3d20686","resolution":{"observed_at":"2026-08-05T14:14:01.472633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:51.159569Z","title":"Gpqa: A graduate-level google-proof q&a benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.159569Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:58f1bb899f597502d4222e1ca741c9bcd665b8ed771566fb23c79bc7d90e1b06","observation_id":"ceddb5c0-b141-4d1f-b8de-54993c4cb4d6","resolution":{"observed_at":"2026-08-05T14:13:51.159569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:51.071623Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.071623Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:4eab2223bc9286e0ceb5bbe23ace26b1c9b4a32901ce7f4f623b6e63e10a7ca0","observation_id":"60dfd04f-6ebc-463e-a135-c076602189ec","resolution":{"observed_at":"2026-08-05T14:13:51.071623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:00.890276Z","title":"On efficient training of large-scale deep learning models.ACM Computing Surveys, 57(3):1–36, 2024","venue":null,"work_id":"3c151a94-462c-4e3a-aeac-6b10f8acbd02","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.355224Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:1950aea10d0a2db26c81e15702cfd0d0e3410ab8ebd76dbcfa00a184b0ebd462","observation_id":"417ee942-3765-45f3-8a07-e6432ad8c204","resolution":{"observed_at":"2026-08-05T14:14:00.984275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:01.103635Z","title":"GitHub - gururise/AlpacaDataCleaned: Alpaca dataset from Stanford, cleaned and curated — github.com.https://github.com/gururise/AlpacaDataCleaned, 2023","venue":null,"work_id":"dba036c6-0280-4f66-bac6-1cfcc1a8116c","year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.232082Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:4b77a02e7726863513380867e2ea6d03ac9e6f94a03b72544216e8c143b99847","observation_id":"7302009f-25b7-428f-9e58-d5142ff2376b","resolution":{"observed_at":"2026-08-05T14:14:01.176835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:00.706131Z","title":"Hashimoto","venue":null,"work_id":"a1b504a6-c0c0-41a4-8c4e-25d479e725bf","year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.547641Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:473ef78f96d74ffec2ca1ecf0998e902e3c373d23129a7f6035eb28032b8fb12","observation_id":"1ebbeb1c-b1aa-4ac9-bfaf-3b78b40c9e44","resolution":{"observed_at":"2026-08-05T14:14:00.796970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01081","last_updated":"2024-04-29T18:55:34Z","snapshot_observed_at":"2026-07-06T17:38:30.401240Z","submitted_at":"2024-03-02T03:48:37Z","title":"LAB: Large-Scale Alignment for ChatBots","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01081","snapshot_observed_at":"2026-08-05T14:13:51.447707Z","title":"Cox, and Akash Srivastava","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.447707Z"},"links":{"cited_paper":"/paper/2403.01081","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:ecf35fb12c6fedf58da1bbc66070d4490b6f541011ba6e89844eec9b9e7835cf","observation_id":"aa155859-eb25-4f6b-8048-03834626c0ec","resolution":{"observed_at":"2026-08-05T14:13:51.447707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:00.522485Z","title":"Let’s synthesize step by step: Iterative dataset synthesis with large language models by extrapolating errors from small models","venue":null,"work_id":"facc39eb-af7d-4614-a578-7ba18316e156","year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.730345Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:f7695aff31d1012b946e8c714190193bef5eca8f223f41f40f0c4a1a214d13e9","observation_id":"acfb7437-85c6-4c3d-901e-0b369fec10bd","resolution":{"observed_at":"2026-08-05T14:14:00.610564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:51.643664Z","title":"Visualizing data using t-sne.Journal of machine learning research, 9(11), 2008","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.643664Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:0cc7e048c6559075053e6cc237d2d9ca658f21bc11e2a244ecbd4c501850d8d8","observation_id":"eba1a0ba-7778-48b4-8f0f-60308b22a657","resolution":{"observed_at":"2026-08-05T14:13:51.643664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:00.167915Z","title":"Eda: Easy data augmentation techniques for boosting performance on text classifica- tion tasks","venue":null,"work_id":"3d14d7a6-47d3-4daf-b60a-0d8db4d8097e","year":2019},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.949852Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:e6f17c814aba4adc14ec81ce87b38d1ff0e76bbde7ced1f943386099f080431c","observation_id":"0a8b08e0-d54e-4bc0-9bf8-b2121d651f64","resolution":{"observed_at":"2026-08-05T14:14:00.244690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:00.344992Z","title":"Self-instruct: Aligning language models with self-generated instructions","venue":null,"work_id":"aca127e6-bf2e-4a54-b242-43cdcc9d06ca","year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:51.879687Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:bff60056f2fb95b257fd93f96573d4e24a6b9044d04686727b7a7a54988303d4","observation_id":"03c38a32-dd25-42c6-bfbf-9263f725d02b","resolution":{"observed_at":"2026-08-05T14:14:00.413297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:59.763914Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","venue":null,"work_id":"3751a0d5-39cd-46b4-aa18-aeeeab6537fe","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.098807Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:c3fdee7936f03ee3839e385a9bc180762a7eb1fd7ed05547be25dafca7b708be","observation_id":"e9cd97a2-5812-4b09-a460-43e1cf8482d2","resolution":{"observed_at":"2026-08-05T14:13:59.883532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:14:00.038266Z","title":"Paranmt-50m: Pushing the limits of paraphrastic sentence embeddings with millions of machine translations","venue":null,"work_id":"f2e5b840-6ccc-411e-b913-ec4602f8bda3","year":2018},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.030856Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:e90688850d1ead53a28517d0c1a0de6ea24e1d9e50858a48ea771b41ce499a0a","observation_id":"404f97ed-e0d2-4bbc-a823-d4a0412e97b4","resolution":{"observed_at":"2026-08-05T14:14:00.119234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:52.264909Z","title":"Magpie: Alignment data synthesis from scratch by prompting aligned LLMs with nothing","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.264909Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:1c86ef21123a6ac2bd7164221530a769e25116553836fb312ad35d5ff6a24c7d","observation_id":"e841da40-4eef-4f28-b5b7-a2eb61b5bae8","resolution":{"observed_at":"2026-08-05T14:13:52.264909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11508","last_updated":"2023-12-27T08:23:14Z","snapshot_observed_at":"2026-08-02T00:30:18.538738Z","submitted_at":"2023-12-12T03:30:21Z","title":"Rethinking the Instruction Quality: LIFT is What You Need","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11508","snapshot_observed_at":"2026-08-05T14:13:52.181382Z","title":"Rethinking the instruction quality: Lift is what you need, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.181382Z"},"links":{"cited_paper":"/paper/2312.11508","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:f16dcc08318b592c15aebfcbfded13c5522cbaed1a6c138c70320b9716e07b62","observation_id":"a2eb3993-4f60-45d6-8c21-3b1ea6afc418","resolution":{"observed_at":"2026-08-05T14:13:52.181382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:52.389523Z","title":"Hellaswag: Can a machine really finish your sentence? InProceedings of the 57th Annual Meeting of the Association for Computational Linguistics, pages 4791–4800, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.389523Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:209d12d9d94e0d4fec6bbc9ed0df6ce3cd1a05170acf2defb5e310a87b0db160","observation_id":"86a9db3f-ebe2-448f-a05c-d93a58116d97","resolution":{"observed_at":"2026-08-05T14:13:52.389523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:59.563307Z","title":"Wavecoder: Widespread and versatile enhancement for code large language models by instruction tuning","venue":null,"work_id":"ba634be5-95ed-42a8-8e53-4d515be79196","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.325553Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:ed3b4742a200dee896c51b1cfa1b4a84a0d61c84acfb6c60f9a8a3a2abb237d6","observation_id":"5f87a2dd-cf0e-4580-8b6b-03644ed445e4","resolution":{"observed_at":"2026-08-05T14:13:59.663763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:59.094368Z","title":"Long is more for alignment: a simple but tough-to-beat baseline for instruction fine-tuning","venue":null,"work_id":"054061f9-2528-4138-8a1c-7439a2b33d60","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.521806Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:296efb17fd9ae5bc7608efdbd012fbb72549bc60a975ba7082f5e3a583c780dd","observation_id":"f9887710-a834-4284-8905-1591e1d2c3b9","resolution":{"observed_at":"2026-08-05T14:13:59.177262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:59.319139Z","title":"Automatic instruction evolving for large language models","venue":null,"work_id":"3294eeec-8074-4280-9361-4f9157dda9c6","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.467844Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:12d4ecbbfa74b8214638b2e8d984ae9764fec86bb0930eafee09c4ff4ccf5a85","observation_id":"052fbefc-2e26-4fa4-8e4f-e62db30928f0","resolution":{"observed_at":"2026-08-05T14:13:59.421993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:58.725458Z","title":"Llamafactory: Unified efficient fine-tuning of 100+ language models","venue":null,"work_id":"815772f9-f060-418f-a169-e9d444cc989b","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.674968Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:08d52707ec42bfe45b2855b7fb0147cbf95a32fdaceb0ae6162b1b1e699bea54","observation_id":"cabeaa76-7fc6-4622-af0e-ed041ec82594","resolution":{"observed_at":"2026-08-05T14:13:58.779824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:58.916777Z","title":"Tree-instruct: A preliminary study of the intrinsic relationship between complexity and alignment","venue":null,"work_id":"7b96b0b1-0fd9-4cd5-9ef8-2521f62b0c89","year":2024},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.595146Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:81e2cb8feceffd8fc5c3a25657ec085bfeecd4a4025d89acad7cfca43512aaa8","observation_id":"a134b35d-3cd1-4112-85e4-f020f9083638","resolution":{"observed_at":"2026-08-05T14:13:58.974897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:52.830369Z","title":"Dataset quantization","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.830369Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:199c0306e036d6f0cac8a8ee243a91997c49c76f349ffd630b6a0ec40bd2d194","observation_id":"949ded7a-cce9-40cf-9150-dd684eae55a5","resolution":{"observed_at":"2026-08-05T14:13:52.830369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:52.726910Z","title":"Lima: Less is more for alignment.Advances in Neural Information Processing Systems, 36: 55006–55021, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.726910Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:88a8263851d14bc29278a99378cd94df5be22eeb326ae8b5e86ef1ccbb28d1fa","observation_id":"1254cb01-0c2d-46b7-825e-e19870ec40ce","resolution":{"observed_at":"2026-08-05T14:13:52.726910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-05T14:13:53.051473Z","title":"Instruction-following evaluation for large language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.051473Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:c8133324fccb31251056eaf2ba01a2ab82f1d2f559b14b192e3719ce30f5ca60","observation_id":"e3b15567-0fad-44d6-80df-c09a7efc2c30","resolution":{"observed_at":"2026-08-05T14:13:53.051473Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:58.513367Z","title":"Davir: Data selection via implicit reward for large language models","venue":null,"work_id":"3c30e8d1-528c-40ab-a784-bcb76ab1f3e2","year":2025},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:52.936109Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:8dce839ec457b7f37e4813f3bb8a12f3b56e31fdddf1c24ab6d8568d4d8bebc4","observation_id":"cdd5d1b3-0b22-432c-83bf-6eb9c2c18755","resolution":{"observed_at":"2026-08-05T14:13:58.603876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:58.352949Z","title":"Figure 9: Self-Alignment instruction score example","venue":null,"work_id":"7909d873-cdba-498f-95bc-4201b2761af1","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.135021Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:09347cc16c96291a79612ed01529766803d62247fa1fc809460b48c53fa912f3","observation_id":"fdb4b7a5-b9a3-4840-aac8-b9097a0e7ce6","resolution":{"observed_at":"2026-08-05T14:13:58.431472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:58.181662Z","title":null,"venue":null,"work_id":"39200576-c008-45f9-be5b-5ec556f488c5","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.255168Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:0c055f599896c0ddc5519463fc0988de16c61b5703bf119f895d468ee0a7cc07","observation_id":"6af83964-6f7b-463b-bedd-b7202b2f7a0d","resolution":{"observed_at":"2026-08-05T14:13:58.269247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:58.045137Z","title":null,"venue":null,"work_id":"68c0d8b3-4208-4bc9-b8da-545426780a00","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.355278Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:ad4696a42911940084c9cbb4b0e1f0c965787df08af6e8947c369af0f8108885","observation_id":"f83ec14f-9223-4220-ade5-c5b074e17e40","resolution":{"observed_at":"2026-08-05T14:13:58.088756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:57.886582Z","title":null,"venue":null,"work_id":"724788ac-0092-4523-bbf4-0873c01df409","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.460460Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:56368f28eb2a6c620ba76ab1ff21e22b27e66af0cdf6bf5d8469d0581826d024","observation_id":"b7375adb-c352-4d6a-afb7-8c7e11d89083","resolution":{"observed_at":"2026-08-05T14:13:57.938886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:57.721497Z","title":null,"venue":null,"work_id":"e365eec5-19f5-49d7-b127-2f2729d167f8","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.539383Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:c0bf5f328fdefb6cf7f809b33a5d47b26b644e67933f039b56f31e101e40b6ea","observation_id":"a9bb2a03-9e1a-47b1-8dbc-abdec927d2fa","resolution":{"observed_at":"2026-08-05T14:13:57.791235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:57.594427Z","title":"Step 2 #Plan#:","venue":null,"work_id":"ede0e9d9-eed2-44f4-957d-0c9311478f92","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.606538Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:3688bc0b47c1341168bc6ed75718eb7a6eb04cf10072b11a00187a9a8a013a58","observation_id":"52526d15-e480-43fb-a2c1-2a47847bff39","resolution":{"observed_at":"2026-08-05T14:13:57.649246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:57.483513Z","title":null,"venue":null,"work_id":"2d6d320c-df46-4603-82bc-1bde0b727312","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.699826Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:f8a2ee882793b15f05b7939f4928b6f0f90a00865e0c2e4421372743ecf5a11a","observation_id":"600e9b15-429c-42aa-9df3-0f103000c994","resolution":{"observed_at":"2026-08-05T14:13:57.535684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:57.322700Z","title":null,"venue":null,"work_id":"9c7c0f3b-46b7-4bcf-b39a-27e2adf86b64","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.763748Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:3d1d09c73cf46f1a5e4271b20fefc844c80be64cbafb871459b726b440a8c26c","observation_id":"0d3239f4-c35d-46a4-ae85-48b8ef08411e","resolution":{"observed_at":"2026-08-05T14:13:57.394760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:57.185562Z","title":null,"venue":null,"work_id":"c5d6441f-f0a0-4aed-a7c1-d53c64f9835e","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.853496Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:bde7c9f54fdbea93225e912f118eb38068bf4e6d991b84b7af5d670ca7f3a4dd","observation_id":"a024d433-ca1e-42e4-ab54-819d9ebb2ab7","resolution":{"observed_at":"2026-08-05T14:13:57.236699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:57.017594Z","title":null,"venue":null,"work_id":"831acaf5-ad94-4d72-81a4-92aa3a0b359f","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:53.967240Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:4e766cdd559a3bba9dd5cd79306135ce454f9e0094e6f2a6254b750b6b0581ad","observation_id":"272c4836-8a7d-4800-84ce-0be2123ef5f3","resolution":{"observed_at":"2026-08-05T14:13:57.107833Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:56.890193Z","title":"Step 3 #Rewritten Prompt#: Find the most frequent number in this list: 3, 7, 2, 3, 5, 7","venue":null,"work_id":"a9b8985b-6c3d-48e7-a578-2399eacba28d","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.062759Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:de7254ee4f97601ed0cae55611889b4a11ee518fbc339bb5952b4a7b48679edd","observation_id":"ca49b8a1-c920-4a7a-9064-efd5f8a955a6","resolution":{"observed_at":"2026-08-05T14:13:56.947365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:56.738524Z","title":null,"venue":null,"work_id":"876e4f14-779f-4a46-a754-443cfd8a12a8","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.158065Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:d55c293de5686c7442633263dbb1c7422a1ec7c408352b9a3c10989fa119563c","observation_id":"4d0bb5cf-f6d6-4517-aeb5-5c9778f65087","resolution":{"observed_at":"2026-08-05T14:13:56.813149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:56.601360Z","title":null,"venue":null,"work_id":"463889a6-caae-420c-bd39-7812a183a159","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.219623Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:097ffb427ea24d5ab1eedfd89726991041a86ff25f5fe853eafd3712ee579ebb","observation_id":"1c94ed0d-7466-48b0-bcd7-2a7ec58361b9","resolution":{"observed_at":"2026-08-05T14:13:56.665171Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:56.437072Z","title":null,"venue":null,"work_id":"69b591d5-9211-4486-8b76-9dc61be38ca7","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.302367Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:705cdb13566ad5b6c9aedab0ce1e97204644acd753fe804bf4ffc80f9c6aad3c","observation_id":"c72e139b-0b03-414f-b4aa-045f7c2adcb6","resolution":{"observed_at":"2026-08-05T14:13:56.510357Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:56.294000Z","title":null,"venue":null,"work_id":"32340707-2d6a-43de-8bda-7bb282135863","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.377029Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:031be193cdbbe8dc29e5f0d3b7431bb49203f92764f5e47fe48dd8814fe278ce","observation_id":"6c788adf-6358-480c-ae38-d7881996f540","resolution":{"observed_at":"2026-08-05T14:13:56.359455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:56.128242Z","title":"Step 2 #Plan#:","venue":null,"work_id":"38653b7d-0504-4b48-8844-a88ae25ed643","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.426453Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:3a1788c6b8da523932f0590f976a9bb5c34a1d6629972a4e6d6a705a8d7c90c0","observation_id":"978d87ff-6504-4139-8fad-4c350c9aac48","resolution":{"observed_at":"2026-08-05T14:13:56.206862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:55.953978Z","title":null,"venue":null,"work_id":"3b4def3f-5973-4681-a84e-79a2548f5838","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.502615Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:3012e00d6458c705cb4ea2de1915926fb346813f44a81256bd7e935554bbbf0b","observation_id":"ba8458ae-1735-4bb7-ab26-5c7a527ae259","resolution":{"observed_at":"2026-08-05T14:13:56.043074Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:55.737745Z","title":null,"venue":null,"work_id":"04e177d6-e267-4b30-9420-b4f1fb198fcb","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.555444Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:0b5cb8be28747d5e5e287fabf4032c9672bd7b11bdd4afed20f77268325812a9","observation_id":"01567768-ee6c-45a2-9975-d95824ce4ccb","resolution":{"observed_at":"2026-08-05T14:13:55.816703Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:55.603322Z","title":null,"venue":null,"work_id":"be253465-1104-4147-a5bd-f37924d4e1fa","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.666108Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:901334448d6a69a27dfa1f57fffa36533ab861ca3abc3bfa755abd3a9f7c1bd3","observation_id":"c623063c-510b-4ec9-88e9-aea826d19b4d","resolution":{"observed_at":"2026-08-05T14:13:55.641027Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T14:13:55.409183Z","title":"Step 3 #Rewritten Prompt#:","venue":null,"work_id":"217bcd3f-976c-45f9-b60d-d4d35ccedb9a","year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:54.748258Z"},"links":{"citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:55dbde8dffbc4418c0bdd328b258514b83189923be24837748f6cc34d3c82c37","observation_id":"da7d506a-c0f3-4ca2-a1ea-05a5dfe0d23d","resolution":{"observed_at":"2026-08-05T14:13:55.513188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-05T14:13:46.955790Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning","version":5},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-05T14:13:46.955790Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2508.21589"},"observation_digest":"sha256:cf1bff4d276db1f79d4ec6f191d71c42caaaf53ab929600c739ed41ef68f01b5","observation_id":"de1154e6-c55d-447a-8c7a-76da4e1bdbda","resolution":{"observed_at":"2026-08-05T14:13:46.955790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.21589","last_updated":"2025-10-22T11:09:23Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T14:13:44.585649Z","submitted_at":"2025-08-29T12:47:27Z","title":"Middo: Model-Informed Dynamic Data Optimization for Enhanced LLM Fine-Tuning via Closed-Loop Learning"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":51,"verified_exact":2,"verified_fuzzy":35},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 0 inbound Pith citation observations for arXiv:2508.21589."}