{"as_of":"2026-08-05T12:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:050791ecf6a1630d803fd1a4143e49365ec580e7e6c6b0422ca8acc58908d09e","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:01:16.854965Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.30077/citation-record","integrity":"/paper/2606.30077/integrity","json":"/paper/2606.30077/citation-record.json","paper":"/paper/2606.30077"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:a2ec1d97c519aaef7ed2c9b00aef5d82882ae7a2b3cdead53f1603bf596f3a19","observation_id":"adc69494-8b91-40f8-832d-9cc6d2ac16ea","resolution":{"observed_at":"2026-06-30T07:04:21.067207Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:71afcfa0e0f893df330116fbca7a30ee41e4ed64ebbde2da6aeee94d52fea315","observation_id":"1ef8d5e5-5a46-45a0-9a6a-a4c112cbfc72","resolution":{"observed_at":"2026-06-30T07:04:21.077748Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00993","last_updated":"2025-04-04T18:29:18Z","snapshot_observed_at":"2026-07-06T21:02:33.351709Z","submitted_at":"2025-04-01T17:31:44Z","title":"MedReason: Eliciting Factual Medical Reasoning Steps in LLMs via Knowledge Graphs","version":2},"cited_work":{"arxiv_id":"2504.00993","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.00993","snapshot_observed_at":"2026-07-10T18:57:31.545185Z","title":"arXiv preprint arXiv:2504.00993 (2025)","venue":"cs.CL","work_id":"bc0e894e-d353-47d9-8714-8b2f7ced1749","year":2025},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"cited_paper":"/paper/2504.00993","citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:8caf7d6a5076d658eedebd4db123a3822e03466eaa255c7cb8bcd34e02b6ad4f","observation_id":"cbc2a4b9-7748-4c8d-a53b-c45daaa82e5d","resolution":{"observed_at":"2026-06-30T07:04:21.074960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Should chatgpt be biased? challenges and risks of bias in large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:0509cf359735a593c48d4c03c7e3e7a241d27e8c161406ffb962368764ffb5df","observation_id":"562c105b-d024-43a0-93f3-a0ad531ba081","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Data shapley: Equitable valuation of data for machine learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:49c0eed20a86dbaad0490d126ebe6a45593ee1537a99c887f893034f207ba6f5","observation_id":"3d7fc474-90c9-47db-b8f2-2ddf9c4dff52","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Understanding black-box predictions via influence functions","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:ac5383a36cb2287d83b3957612b8079180c74768baf32342357fec1931b6cd8f","observation_id":"f2f1af9e-f7d5-429a-aad6-0ebd91261d23","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Greats: Online selection of high-quality data for llm training in every iteration.Advances in Neural Information Processing Systems, 37:131197–131223, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:43596d6215d90e45db32bf889bb2867513ffaf8ac67bcd91471684c507e8642a","observation_id":"910a9e0c-8efa-4ab2-b5ac-b9455979217f","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Lava: Data valuation without pre-specified learning algorithms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:335a4c412d767379e070c269eba7b4aa2bf42e7ef58b9c7c1dba86ff3490051f","observation_id":"bd1fe518-8311-4bb2-8846-a30cf81b6883","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Sava: Scalable learning-agnostic data valuation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:46eb1bb7cd3850f77bf72914d0e8040724b8f54e563e7dfeb0d8b151f3bac936","observation_id":"1046bd87-bd53-44e1-99a2-5c6127f148a5","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Kairos: Scalable model-agnostic data valuation.Advances in Neural Information Processing Systems, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:5b372a637362fde883f147579dbf76cf9ce7f2946d09defadc645a6d135a88b2","observation_id":"d20521ce-c9fc-4b35-9dd0-3c970a985b3f","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Shapley-based data valuation for weighted k-nearest neighbors","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:8fbac8cee2383d3c09d4291fcab5623c2f900f1850bae3264a15fca89076a6d8","observation_id":"b0766dca-3b9a-4814-9f00-b1780fa3a0a6","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"What is your data worth to gpt? llm-scale data valuation with influence functions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:8965ce57ee1c053c87d525d60dbba63f20e240fa519c7561603c14c498903960","observation_id":"9209e504-eff8-4ea8-b164-1e703d27fc41","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Dataset distillation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:4e630b3280458e5e4d79833762432adf2228f630c569f49a2eb1168f3d57ab67","observation_id":"447c67ff-d3b7-4c81-b7fa-0f226f2461e0","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Coresets for data-efficient training of machine learning models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:f01adca864de25fe885b668adcc2b99de3baa12e8f1e36de1a19706c4a9fc29c","observation_id":"7d3f2ed4-b0c1-4e54-b669-721eb6ba0df0","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Estimating training data influence by tracing gradient descent.Advances in Neural Information Processing Systems, 33: 19920–19930, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:94277894edb790e1d4f7e0f086056d7b1df1aa08973cbfeb5604ce66e3b8c054","observation_id":"443623fa-8ddc-4b2b-8604-4f3677256921","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Rethinking data shapley for data selection tasks: Misleads and merits","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:fca321241b565cfa7b7d027b1a4274b34f7b11cc0df7288a5e565b1c7919761c","observation_id":"18d7abed-f84d-4b14-b9fb-7b814dab03ae","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Doremi: Optimizing data mixtures speeds up language model pretraining.Advances in Neural Information Processing Systems, 36: 69798–69818, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:6bd7f70e17569f0a1840d7f2afdf3e9ca01c2cd5ff5825a56d44b898869f5306","observation_id":"0b6a4101-34db-4cf8-837c-5ea048e7ecd0","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Less: selecting influential data for targeted instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:1a8957aa9a52808a59206aaab145105daa21836de84cdfedbaa6d6d359d0ed0b","observation_id":"35072153-1e3a-45ca-a8c1-cd809c77d4f7","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Qurating: Selecting high- quality data for training language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:088ce3c9b3840e40a6ca8bd879bfbf0d9cb0de74e4d09910387c244210b755c5","observation_id":"6185285c-db87-46f9-9c11-13b81e6036aa","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"An empirical study of example forgetting during deep neural network learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:dfe1e0b54ef801190355f7a86d74d0b4d73bb458ebfa4dcb13711a341cd3c231","observation_id":"2f3fb830-30f6-4dbe-a5f1-77e6affd1bb2","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Deep learning on a data diet: Finding important examples early in training.Advances in neural information processing systems, 34:20596–20607, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:341cffb7acfb37e42ccebef706d11d3c095a68dcc0b87b9ca3ef7416af286c0e","observation_id":"3457ef35-d5bb-48ce-86d2-b7c81c14d945","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Beyond neural scaling laws: beating power law scaling via data pruning.Advances in Neural Information Processing Systems, 35:19523–19536, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:113de244f17a8cf702d214e8080da4247c9589dd7c3d3e26c74601c18992af54","observation_id":"9d340364-7578-40ae-9034-1ecdcf4df77a","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Tracking the best expert.Machine Learning, 32(2): 151–178, 1998","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:a5b2b6b582b1d974498683e3956709cf202c5768f205bd27611197054574b90d","observation_id":"75a5c97b-83fa-4d03-849a-6f0b88d5f0f2","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Cambridge University Press, 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:9582510a4c9c868372a0ad592f3a7616948a802327ac3f5e3f041c9a31d1feac","observation_id":"b9337d63-bd30-492b-8a5e-03bcb37d2e4a","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Measuring massive multitask language understanding.Proceedings of the International Conference on Learning Representations (ICLR), 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:8066a7e9bc8bcd924baf6314cf2e1fee105cba737c8626e0bc777c571722151e","observation_id":"82fda2b2-15ca-4205-adfe-7817b9e12cb5","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"SAMSum corpus: A human-annotated dialogue dataset for abstractive summarization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:d52cda0a82a31737e278de9ef700d96fbea90396f7e8f993ba031c8db8b09baf","observation_id":"446e3934-7a31-4485-82eb-e1f564eb2fb7","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Clark, Eunsol Choi, Michael Collins, Dan Garrette, Tom Kwiatkowski, Vitaly Nikolaev, and Jennimaria Palomaki","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:547607da17ca3e24a935764b23f2f5c432e14e4cb27e7e8e5a5c48ac64bccde1","observation_id":"cf2964f3-79a5-4653-a6fc-9b117ee0514a","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:3c590bb489eb1beefe2562d01bf50076470f8a3997028e5bee2deab877826046","observation_id":"2c6668a9-d9b5-4cfe-a63e-a0836bb987d8","resolution":{"observed_at":"2026-06-30T07:04:21.083490Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":"2407.21783","doi":"10.1016/s0749-0720(15","metadata_source":"pith","pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"The Llama 3 Herd of Models","venue":"cs.AI","work_id":"1549a635-88af-4ac1-acfe-51ae7bb53345","year":2024},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:a50e3626bcd91b4d64e668bf5e9aaa5fe0316f87e7edbdbadd3ab745c6472dae","observation_id":"a06183d2-8be2-4f9a-951e-50d6549ec13e","resolution":{"observed_at":"2026-06-30T07:04:21.086103Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:d195591b0eb5f49c64ec7994c4b836b08325659eb910e60364e81e3b417d0a26","observation_id":"b7271dc0-330c-4f02-a888-a8082bc0aac9","resolution":{"observed_at":"2026-06-30T07:04:21.080706Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:0dbcdadeb32f960a25da879496ebbe1aed8246d1efdd6f86ff4c0220c666468f","observation_id":"1d038b87-1b60-49ee-b226-d091b22bf4fa","resolution":{"observed_at":"2026-06-30T07:04:21.083735Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":"2310.06825","doi":"10.48550/arxiv.2310.06825","metadata_source":"pith","pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mistral 7B","venue":"cs.CL","work_id":"eb5e1305-ad11-4875-ad8d-ad8b8f697599","year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:a6064effebb5dbc3b7dc0a162ceef5154db5eeee98e4d2a2223ed496565b7500","observation_id":"e159c18e-7968-49ec-926e-886141fdf96a","resolution":{"observed_at":"2026-06-30T07:04:20.452059Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T03:08:12.282824+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Sentence-bert: Sentence embeddings using siamese bert- networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:25363458c4bfb8cc53315e387c9213a66dd0271e460a3e0ac9406e149a08104f","observation_id":"4840421f-712c-4ba7-b142-1129061d92d5","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"MIT press Cambridge, MA, 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:5fd8b2015fe0ae5764302f7c475fe54353599b8a2ce3ad3c1a3c3ff81e8a9beb","observation_id":"73ba7e50-4965-41bd-bc34-5f9def389d85","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Tighter bounds on the log marginal likelihood of gaussian process regression using conjugate gradients","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:e55d96b85310bef592277a08b6ac40bf71d1b5c9f23a81cd7c9360eb48bbdc25","observation_id":"76870e90-13cc-4a1a-bd3f-cc4df6cb9f4a","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:7a82c93dcc85e18083b6bf9f97c29c97188f6777e14edebb3db438626a4c12a2","observation_id":"c29d1279-5a79-48a3-98d5-8b0b4ff7eaa4","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"The flan collection: Designing data and methods for effective instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:897344a4b79358bcde2d80fd42024066437fa894b5940900eba2ae1c92624769","observation_id":"96333040-97d0-4e07-904f-5c4b83dabddc","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:9c3c53460b185d2b98e68fba561e829d7990276be0e12070f6cda621f08a4889","observation_id":"094e2160-f50d-46cf-96e8-a961d8434a75","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Free dolly: Introducing the world’s first truly open instruction-tuned llm, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:30969299900c5490766bd84ae69d809e6e0c927b4b90daf97fff9d1b1e5c04a2","observation_id":"76cc5da7-7924-492c-8f9f-959493280346","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Openassistant conversations-democratizing large language model alignment.Advances in neural information processing systems, 36:47669–47681, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:cd55cebe8034170dd33397f891131df5d465f63c00a21bbb150b8ff4dd6adc92","observation_id":"4a14c9e9-9874-4baa-adaa-09192aac4bca","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Gpytorch: Blackbox matrix-matrix gaussian process inference with gpu acceleration.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:7c94b8de29f3fe139828254a306a822729a035e7e56c1f098fb4d84dd2ab8f01","observation_id":"ee466375-d50b-49b6-bcf6-813e78639072","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:01:16.854965Z","title":"Not all samples are created equal: Deep learning with importance sampling","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:1b2459439175e50b15a955413dd27739b7e5d6ef3d16fca7e63775c95bc22d49","observation_id":"a10ba5e5-1f04-4aee-b33e-265315203182","resolution":{"observed_at":"2026-06-30T07:01:16.854965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06343","last_updated":"2016-04-25T14:00:21Z","snapshot_observed_at":"2026-07-06T04:37:08.670695Z","submitted_at":"2015-11-19T20:24:09Z","title":"Online Batch Selection for Faster Training of Neural Networks","version":4},"cited_work":{"arxiv_id":"1511.06343","doi":null,"metadata_source":"pith","pith_arxiv_id":"1511.06343","snapshot_observed_at":"2026-07-09T21:36:34.306361Z","title":"Online Batch Selection for Faster Training of Neural Networks","venue":"cs.LG","work_id":"35a8790d-539d-4362-b36d-6c27d43a6860","year":2015},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"cited_paper":"/paper/1511.06343","citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:5574071c61e546401d495e845accc44f04736e9e00f6f5a17f66fa7302e3fcd1","observation_id":"1d20716b-6e4f-4581-8d9e-6434a78952b1","resolution":{"observed_at":"2026-06-30T07:04:21.089014Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2786.17856","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T07:04:21.090201Z","title":"Gomez, Adrien Morisot, Sebastian Farquhar, and Yarin Gal","venue":null,"work_id":"0eeb825d-6803-4d77-9194-7c370e2a5973","year":2022},"citing_paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T07:01:16.854965Z"},"links":{"citing_paper":"/paper/2606.30077"},"observation_digest":"sha256:325af14073eb49aef5dba9a813a518cfc86d0965d58d1b935d5ca0cab18c72c0","observation_id":"a08977e8-3998-41c7-b7a6-c9e01debcdd7","resolution":{"observed_at":"2026-06-30T07:04:21.091847Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.30077","last_updated":"2026-06-29T10:08:12Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-03T16:40:24.084893Z","submitted_at":"2026-06-29T10:08:12Z","title":"Online Data Selection for Instruction Tuning via Gaussian Processes"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":8,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2606.30077."}