{"as_of":"2026-08-08T09:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a7820ce701283d839185285eb06b088cf3dff0538b07e7e17845521faf038cc5","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:35:44.945688Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-03T16:44:41.720388Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:48:39.449857Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"cited_work":{"arxiv_id":"2505.24844","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24844","snapshot_observed_at":"2026-07-03T16:48:39.449857Z","title":"Chameleon: A flexible data-mixing framework for language model pretraining and finetuning","venue":null,"work_id":"eaf3e70a-28b0-46aa-9d62-b7a6a1657d93","year":2025},"citing_paper":{"arxiv_id":"2604.16380","last_updated":"2026-03-25T13:30:40Z","snapshot_observed_at":"2026-08-08T06:45:13.140900Z","submitted_at":"2026-03-25T13:30:40Z","title":"Data Mixing for Large Language Models Pretraining: A Survey and Outlook","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:04.958757Z"},"links":{"cited_paper":"/paper/2505.24844","citing_paper":"/paper/2604.16380"},"observation_digest":"sha256:4b8271fdd6310a2a4b64f47c61533947cca51aefe72e99ded0f6b9b6834490b1","observation_id":"daa3f0a0-bd0b-41b4-9534-615953804898","resolution":{"observed_at":"2026-05-15T00:58:25.742553Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"cited_work":{"arxiv_id":"2505.24844","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.24844","snapshot_observed_at":"2026-07-03T16:48:39.449857Z","title":"Chameleon: A flexible data-mixing framework for language model pretraining and finetuning","venue":null,"work_id":"eaf3e70a-28b0-46aa-9d62-b7a6a1657d93","year":2025},"citing_paper":{"arxiv_id":"2607.02266","last_updated":"2026-07-02T14:51:42Z","snapshot_observed_at":"2026-08-01T16:10:16.151976Z","submitted_at":"2026-07-02T14:51:42Z","title":"HERMES: A Multi-Granularity Labeling Substrate for Pre-training Data Mixtures","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-03T16:44:41.720388Z"},"links":{"cited_paper":"/paper/2505.24844","citing_paper":"/paper/2607.02266"},"observation_digest":"sha256:97e2d1e182da1747ef6dd45f1a566cd01882b5b03efcab53914334a5560266a1","observation_id":"0d40c740-2663-4d1c-bb09-1788df5e4c44","resolution":{"observed_at":"2026-07-03T16:48:39.451436Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.24844/citation-record","integrity":"/paper/2505.24844/integrity","json":"/paper/2505.24844/citation-record.json","paper":"/paper/2505.24844"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:38.503981Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.503981Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c336ebf876e1132dcacdab9cdee95913df90fe58a2ec4680bf17fe99d170ff07","observation_id":"b3f3af47-ab0b-4944-8a1e-0d11b5d39ba9","resolution":{"observed_at":"2026-08-07T12:35:38.503981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.0306","last_updated":"2015-11-08T20:33:45Z","snapshot_observed_at":"2026-07-06T03:59:18.014244Z","submitted_at":"2014-11-02T19:57:31Z","title":"Fast Randomized Kernel Methods With Statistical Guarantees","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.0306","snapshot_observed_at":"2026-08-07T12:35:38.631002Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.631002Z"},"links":{"cited_paper":"/paper/1411.0306","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c2b4aab166be594413c9e509f42d28d4eba7ef0b1f053f57d4342d0a05e04cea","observation_id":"f79284cf-cb42-449d-838c-3a8f2c821a35","resolution":{"observed_at":"2026-08-07T12:35:38.631002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:53.210166Z","title":null,"venue":null,"work_id":"bfe46d29-f03b-49dc-a5e3-5de88f23aa17","year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.718840Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:6dc8c4a7cb21101621403222b14a259c3564f0e7b9b6c00b33bca2d6118481b1","observation_id":"dd4f53e5-1b52-40b0-8d45-6e3e3908d583","resolution":{"observed_at":"2026-08-07T12:35:53.333515Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.992585Z","title":"Sharp analysis of low-rank kernel matrix approximations","venue":null,"work_id":"b834c2e9-255d-4d23-b10b-c97678376331","year":2013},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.787906Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:0707db18374a7db6b8cb16b5675746b7600e31853dd9c8b41d5adaef1e8423bd","observation_id":"9b3b7a62-c4f4-4b78-987d-d7cc769af6f0","resolution":{"observed_at":"2026-08-07T12:35:53.080460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.811848Z","title":"B., and Stylianopoulos, N","venue":null,"work_id":"19295b25-6900-4e7d-b4a3-63618d834fff","year":2021},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.902143Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:f63008f7623c864cca2ce3c2f81672ea0cb8c5a522180b8c6fff1e32f03db9fb","observation_id":"a56dba4a-6129-49c8-8ce3-f3eb14834600","resolution":{"observed_at":"2026-08-07T12:35:52.906128Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.654364Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":"20db9eca-4a59-4bd8-bc1c-e584c494fa68","year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:38.976247Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:e75f09c89a3610c8e876ef4d6671df782fefc453cdc8985909ba77dab51bae98","observation_id":"2f4e55df-f392-4929-a82a-d736c511e1c1","resolution":{"observed_at":"2026-08-07T12:35:52.731218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:39.047968Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.047968Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:3f207d7fe8049c698f8a9b43bc9b97511e1a02326dd9c7c545e2f82fc31de3f3","observation_id":"b30ac921-47fb-4036-abd2-5361d1de8069","resolution":{"observed_at":"2026-08-07T12:35:39.047968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.515271Z","title":"Analysis of nystr \\\"o m method with sequential ridge leverage score sampling","venue":null,"work_id":"a3f01000-68a9-4ab1-943b-c065b950d0bc","year":2016},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.122716Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:4368967581c00615ce3ae4cd3a8d2fa99a13e0006bbae76995333c6e208a81f8","observation_id":"7fbd5401-2195-4b69-839d-07d6eea4a633","resolution":{"observed_at":"2026-08-07T12:35:52.574209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.355274Z","title":"and Yang, Y","venue":null,"work_id":"12ff006e-3924-474a-8b68-fdb619557550","year":2021},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.201995Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:3353d9e45b768cd6a604bb98a0a7ceac76b4b7c2f455f678749e1e0f4e60d030","observation_id":"278990ec-cd76-42d6-b790-d54e321149ba","resolution":{"observed_at":"2026-08-07T12:35:52.440369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T12:35:39.280395Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.280395Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:394f399b34e797ccc84e00ced6c4f97e9ce1ecda2c8b88113b7bfee6b2d9ad60","observation_id":"1c6eb76e-8c0a-4689-b2b3-782fa9d66a5a","resolution":{"observed_at":"2026-08-07T12:35:39.280395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.07263","last_updated":"2016-10-06T22:48:49Z","snapshot_observed_at":"2026-07-06T04:37:28.029641Z","submitted_at":"2015-11-23T15:10:05Z","title":"Input Sparsity Time Low-Rank Approximation via Ridge Leverage Score Sampling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.07263","snapshot_observed_at":"2026-08-07T12:35:39.359944Z","title":"B., Musco, C., and Musco, C","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.359944Z"},"links":{"cited_paper":"/paper/1511.07263","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:a1a79d72ec9b139ba05d54ae321522dadd0a4b523195c164bef70e02946a7169","observation_id":"e086f306-5235-4db8-b0df-acbfc899db2f","resolution":{"observed_at":"2026-08-07T12:35:39.359944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.185155Z","title":"B., Musco, C., and Musco, C","venue":null,"work_id":"45a9f5c8-c79e-4e46-8e1e-3bb94ffb495d","year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.456117Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:47bd6d5211a8e6e4b1ce27692648d1495d41f5d31c2e7511da4549dd203631e6","observation_id":"01ba9733-8ce0-4bf4-b1e7-3877415db091","resolution":{"observed_at":"2026-08-07T12:35:52.263988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:52.045130Z","title":"Multivariate christoffel functions and hyperinterpolation","venue":null,"work_id":"f24b6459-1ecd-4397-8624-3089f6ce6f98","year":2014},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.536150Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:4c74e9b1a67e452ffa0b656564269c2f458cf0651a5e6a6afa5b80ce9b50a1d2","observation_id":"ce4338ec-32a4-4cb6-a4d2-f1892d733728","resolution":{"observed_at":"2026-08-07T12:35:52.122473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:51.841702Z","title":"M., Tong, S., Lepikhin, D., Xu, Y., Krikun, M., Zhou, Y., Yu, A","venue":null,"work_id":"fc1ed593-ae84-4784-a59e-37eddd3f8165","year":2022},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.652667Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:b503e01add9fd6d24233ae95dce34842439db17835293952034a3cb7e12ffc68","observation_id":"d9b443af-97ae-4350-a8ab-5fd403456981","resolution":{"observed_at":"2026-08-07T12:35:51.922321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:35:39.720002Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.720002Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:a17489cea19b750cb23441cc1d434e278b4b7e44b9aafff13a8e5631796deb15","observation_id":"380f1443-4da2-442c-86b3-82838e03bb22","resolution":{"observed_at":"2026-08-07T12:35:39.720002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:51.621066Z","title":"Leveraging the christoffel function for outlier detection in data streams","venue":null,"work_id":"65aabf75-f43c-4dbe-a320-848e168f0d6c","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.845167Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:45efd94645bb2b5fe4a151136d34e9da31a21b1d1c5575c71bf3eb10b1f9ca15","observation_id":"d13ab9fc-b31e-41a0-ac62-e48ad12035af","resolution":{"observed_at":"2026-08-07T12:35:51.720521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:51.346262Z","title":null,"venue":null,"work_id":"ca10cf9e-e56b-4866-8853-092a39123f13","year":2014},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:39.919943Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:857781b91a9da1d5cc53fc8fabe172ba4a37a47966fde3354ec63b001dc6d603","observation_id":"00054f01-6e16-473e-9eeb-0913ae1d4dcd","resolution":{"observed_at":"2026-08-07T12:35:51.501689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02498","last_updated":"2024-10-03T14:00:44Z","snapshot_observed_at":"2026-08-05T18:55:08.459445Z","submitted_at":"2024-10-03T14:00:44Z","title":"Dynamic Gradient Alignment for Online Data Mixing","version":1},"cited_work":{"arxiv_id":"2410.02498","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.02498","snapshot_observed_at":"2026-08-07T12:35:45.299249Z","title":"Dynamic Gradient Alignment for Online Data Mixing","venue":"cs.LG","work_id":"194f7ea2-5f63-414e-a401-4a07661aca56","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.028666Z"},"links":{"cited_paper":"/paper/2410.02498","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:958ad738fcc7fc25a0432bd64ebfb52c41ce68eef7e6af8f5fca3d3b5d41ac2f","observation_id":"51e9940f-84a8-4e96-885d-66991935c67f","resolution":{"observed_at":"2026-08-07T12:35:45.364390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:51.070512Z","title":"DOGE : Domain reweighting with generalization estimation","venue":null,"work_id":"396c9bd4-b15a-48e9-8dbb-9855d75e4229","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.166611Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:8eda7d1d987ee01dcedc5e0e7a227eb5ec5f676ee9b552302c01f163be6b3a47","observation_id":"b3b65340-679b-42bb-bbc7-408c87847d30","resolution":{"observed_at":"2026-08-07T12:35:51.161312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.705059Z","title":null,"venue":null,"work_id":"7f6cacc0-54cf-43ad-b898-e14d7b9e6bf4","year":2022},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.351695Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:a4936dc96c1148f0ef99df1bb76bba56b2f8142d96f4a41d9a4efe1633c6f118","observation_id":"d7eacd52-3ee0-42af-957d-3736b71854a6","resolution":{"observed_at":"2026-08-07T12:35:50.927863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15285","last_updated":"2024-12-18T18:41:18Z","snapshot_observed_at":"2026-07-06T20:10:29.099784Z","submitted_at":"2024-12-18T18:41:18Z","title":"Maximize Your Data's Potential: Enhancing LLM Accuracy with Two-Phase Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15285","snapshot_observed_at":"2026-08-07T12:35:40.495825Z","title":"Maximize your data's potential: Enhancing llm accuracy with two-phase pretraining","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.495825Z"},"links":{"cited_paper":"/paper/2412.15285","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7c57d98a70c26623a44edd125904dde424f28e64cdcdb82aafd089b01ef46370","observation_id":"ed9a85c7-fce3-48df-8edd-4c624c12522a","resolution":{"observed_at":"2026-08-07T12:35:40.495825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T12:35:40.638808Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.638808Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:871e16b53204071fa5dec6a32d38f300d2cc3bfaf3bca3d2252aa15974ea1de0","observation_id":"33e7cd2f-c33a-4fa8-9d0c-3df679a513d1","resolution":{"observed_at":"2026-08-07T12:35:40.638808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.404701Z","title":"A framework for few-shot language model evaluation, 2024","venue":null,"work_id":"785ce8ff-30f0-43ff-819c-91936df84bbf","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:40.839268Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:6d85810d6cde5d13c4fe221540e0f01358b099c257fedf5b457ce98dbe5488a9","observation_id":"b2abb185-ba50-4701-a7cc-0209d60c8d74","resolution":{"observed_at":"2026-08-07T12:35:50.506652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.353396Z","title":"An introduction to statistical learning: with applications in R","venue":null,"work_id":"59526bb3-4b84-4a76-b2e5-1480b4abe438","year":2013},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.017439Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:48c445d57da298760e83885dcc16d84debb728db68d559b7dcbc2f12e508afd3","observation_id":"043fde3c-f671-4c8e-af53-7afc339a4493","resolution":{"observed_at":"2026-08-07T12:35:50.395008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.165935Z","title":"Wiki-40b: Multilingual language model dataset","venue":null,"work_id":"c0958b2e-691e-4863-b267-44e3e8d1f53a","year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.157937Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:ab2690fcc78d22abd75348957d3919f0bca4130d7ea09565b65a41affa9c5c41","observation_id":"59c670a5-a10c-430d-b88e-1fe7c6a0de53","resolution":{"observed_at":"2026-08-07T12:35:50.249819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:50.003435Z","title":"The elements of statistical learning: data mining, inference and prediction","venue":null,"work_id":"c7c8d5eb-37ce-4a89-aed6-3929db3902a3","year":2005},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.258586Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7b9e14b426ab3364d7f72b61a4beb42cf24a3d5706f4d0960f158be22c6f5a7b","observation_id":"0ca0147c-e911-4038-9912-ae1e484d97a8","resolution":{"observed_at":"2026-08-07T12:35:50.088307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11820","last_updated":"2024-10-15T17:47:44Z","snapshot_observed_at":"2026-08-04T18:20:45.624958Z","submitted_at":"2024-10-15T17:47:44Z","title":"Adaptive Data Optimization: Dynamic Sample Selection with Scaling Laws","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11820","snapshot_observed_at":"2026-08-07T12:35:41.369147Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.369147Z"},"links":{"cited_paper":"/paper/2410.11820","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:db03ea1c8c32a9712e522f8cb77219f2b29c97ac69a3f4d22f7d29cf34b03859","observation_id":"1fb5bd19-70eb-4a72-9e70-11a649b5f5f6","resolution":{"observed_at":"2026-08-07T12:35:41.369147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:41.513536Z","title":"Autoscale: Automatic prediction of compute-optimal data composition for training llms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.513536Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:65ad37aaf8061b392c4f0d453badb1c8cd76f95db47e1c0bffff1b18d11ff1ab","observation_id":"7a0a942d-38d8-4917-a791-0fcef23d878c","resolution":{"observed_at":"2026-08-07T12:35:41.513536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:49.851161Z","title":"Looking beyond the surface: A challenge set for reading comprehension over multiple sentences","venue":null,"work_id":"12562e88-e972-407d-bb64-cfbcadfae9ec","year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.639380Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:f51074bd7e1270ed5070ba5be7830b715d67f67a3060956c7eadb6fa32f9340f","observation_id":"c592ddbb-c97b-4bbe-a438-535afb3b0a9f","resolution":{"observed_at":"2026-08-07T12:35:49.919292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15533","last_updated":"2022-11-20T18:15:30Z","snapshot_observed_at":"2026-07-06T14:24:01.962012Z","submitted_at":"2022-11-20T18:15:30Z","title":"The Stack: 3 TB of permissively licensed source code","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15533","snapshot_observed_at":"2026-08-07T12:35:41.731039Z","title":"B., Li, J., Mou, C., Ferrandis, C","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.731039Z"},"links":{"cited_paper":"/paper/2211.15533","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:f2a95f85fb42930ee0421703fb2cfd74172041079a489b475a6396f93bd37524","observation_id":"44b966dc-a8f5-4ef8-83e2-45e76205e9dc","resolution":{"observed_at":"2026-08-07T12:35:41.731039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04683","last_updated":"2017-12-05T19:36:03Z","snapshot_observed_at":"2026-08-07T10:40:47.462532Z","submitted_at":"2017-04-15T19:31:41Z","title":"RACE: Large-scale ReAding Comprehension Dataset From Examinations","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04683","snapshot_observed_at":"2026-08-07T12:35:41.838461Z","title":"Race: Large-scale reading comprehension dataset from examinations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.838461Z"},"links":{"cited_paper":"/paper/1704.04683","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c7d15ec02f5bfac741f9a109eda595dbdd1212aa3fee21026a986081c0e84e1d","observation_id":"0199387e-b1d3-480b-af7d-0ae72d21cafb","resolution":{"observed_at":"2026-08-07T12:35:41.838461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:49.460068Z","title":null,"venue":null,"work_id":"bf6435c4-d5f0-44b8-8db0-a078e7a18344","year":2019},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:41.957391Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:57e02f3943d07edc716468fe05ba9f66830188f2f4f25d869418c5dea4db6c55","observation_id":"a4351c0a-630a-4f6e-9047-6a3a5400b16f","resolution":{"observed_at":"2026-08-07T12:35:49.703606Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:48.919166Z","title":"L., and Peng, R","venue":null,"work_id":"96d81380-ee94-4ecc-85b4-a889d3a06877","year":2013},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.054731Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c7255b9d3689bf93c0aaae44fa70c7746d4593bcae44df71f2775866d8028db3","observation_id":"7d0b0457-dd98-405f-b895-4bffbcd3e019","resolution":{"observed_at":"2026-08-07T12:35:49.227083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08124","last_updated":"2020-07-16T05:52:16Z","snapshot_observed_at":"2026-07-06T09:38:41.713097Z","submitted_at":"2020-07-16T05:52:16Z","title":"LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08124","snapshot_observed_at":"2026-08-07T12:35:42.123008Z","title":"Logiqa: A challenge dataset for machine reading comprehension with logical reasoning","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.123008Z"},"links":{"cited_paper":"/paper/2007.08124","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:85cf47868bb0056215235afde8aa5c94eea1a8f39dfdb1c868d4367c239b7842","observation_id":"d17e5040-a200-4cb6-b809-43f28a19b253","resolution":{"observed_at":"2026-08-07T12:35:42.123008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01492","last_updated":"2025-01-23T17:35:43Z","snapshot_observed_at":"2026-07-06T18:39:43.472708Z","submitted_at":"2024-07-01T17:31:03Z","title":"RegMix: Data Mixture as Regression for Language Model Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01492","snapshot_observed_at":"2026-08-07T12:35:42.207728Z","title":"Regmix: Data mixture as regression for language model pre-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.207728Z"},"links":{"cited_paper":"/paper/2407.01492","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c016c4994aecd2c6765b841bb770cefed9df78489e2c06b9bda8ddf779fda0d2","observation_id":"7ef517de-48b5-4365-bb9b-1415edd4590a","resolution":{"observed_at":"2026-08-07T12:35:42.207728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:48.547864Z","title":"A pretrainer`s guide to training data: Measuring the effects of data age, domain coverage, quality, & toxicity","venue":null,"work_id":"aac961f5-2f57-440a-889e-cd01c4beae1a","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.302526Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:760be1c7d485ab0e08fc7fad2488479bf51cda3c09a1b5d3ad3e763a96d59740","observation_id":"8cb0cd30-5f23-4188-a319-8bc17f062cd2","resolution":{"observed_at":"2026-08-07T12:35:48.684891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16298","last_updated":"2023-09-30T07:01:13Z","snapshot_observed_at":"2026-07-06T16:24:49.716011Z","submitted_at":"2023-09-28T09:50:27Z","title":"At Which Training Stage Does Code Data Help LLMs Reasoning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16298","snapshot_observed_at":"2026-08-07T12:35:42.400029Z","title":"At which training stage does code data help llms reasoning? arXiv preprint arXiv:2309.16298, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.400029Z"},"links":{"cited_paper":"/paper/2309.16298","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:81dda848894010e625ba2e8c6ebb550dffa80e149bf5cd670801a93872ba26ef","observation_id":"b604cae5-2271-4340-bd58-428587ad586b","resolution":{"observed_at":"2026-08-07T12:35:42.400029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:48.335108Z","title":null,"venue":null,"work_id":"679f6f7e-21c5-42b7-bb03-778386467d98","year":2009},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.551788Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:1901321ce37af9e8bb17c88b6f9623c4b2c2f0c5ac2b3f7892feb1e07f1a284e","observation_id":"5cc82a3e-b6f7-45b5-a4f1-65d731824aed","resolution":{"observed_at":"2026-08-07T12:35:48.414496Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.968360Z","title":"When not to trust language models: Investigating effectiveness of parametric and non-parametric memories","venue":null,"work_id":"acce7616-9b2e-4fed-9660-0139e6020429","year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.648814Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:993145bb5af96b83929b6adf7bc8fc9abbd4a6c2eecd8d9374bc8e53535f9879","observation_id":"82154177-26b6-4222-85f4-a8772a31ffa7","resolution":{"observed_at":"2026-08-07T12:35:48.154308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.03426","last_updated":"2020-09-18T01:56:41Z","snapshot_observed_at":"2026-08-02T15:32:07.466568Z","submitted_at":"2018-02-09T19:39:33Z","title":"UMAP: Uniform Manifold Approximation and Projection for Dimension Reduction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.03426","snapshot_observed_at":"2026-08-07T12:35:42.804042Z","title":"Umap: Uniform manifold approximation and projection for dimension reduction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.804042Z"},"links":{"cited_paper":"/paper/1802.03426","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:497878f86eb6f85abe5862f72583d62f0c8bbd3eca1776f6fb0e3d1cb40cb250","observation_id":"f337cb77-b714-4833-a708-daef5c4f64cd","resolution":{"observed_at":"2026-08-07T12:35:42.804042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-07T12:35:42.897037Z","title":"Can a suit of armor conduct electricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.897037Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:c7b5c83cc2a49b63ca6e58adf3eacac52d11d33ae93dcd3d916d2f89bfb5dc07","observation_id":"bad7de74-0c25-49fd-b56b-08022230fa8b","resolution":{"observed_at":"2026-08-07T12:35:42.897037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.792878Z","title":"and Musco, C","venue":null,"work_id":"aaa40670-fdf4-4bb1-b416-ed35a4b8cd1d","year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:42.996312Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:55c888cdaa424dbf888aea169458445e8d6985ef0d21392878bb840fc2b8a406","observation_id":"e1959f7f-8fbd-4119-9c60-c8f1a4536c34","resolution":{"observed_at":"2026-08-07T12:35:47.868679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06031","last_updated":"2016-06-20T09:37:17Z","snapshot_observed_at":"2026-08-05T16:27:22.031013Z","submitted_at":"2016-06-20T09:37:17Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06031","snapshot_observed_at":"2026-08-07T12:35:43.087650Z","title":"N., Bernardi, R., Pezzelle, S., Baroni, M., Boleda, G., and Fern \\'a ndez, R","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.087650Z"},"links":{"cited_paper":"/paper/1606.06031","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:0108e2c6e286a4a8694a4b5f2348b1cb5d49e8c8bd5e38d2083c7e57968532d7","observation_id":"7c59eaff-d040-4bda-be13-f0055e2cfb84","resolution":{"observed_at":"2026-08-07T12:35:43.087650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06380","last_updated":"2024-10-19T16:51:38Z","snapshot_observed_at":"2026-07-06T18:43:22.614883Z","submitted_at":"2024-07-08T20:47:58Z","title":"Data, Data Everywhere: A Guide for Pretraining Dataset Construction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06380","snapshot_observed_at":"2026-08-07T12:35:43.210706Z","title":"Data, data everywhere: A guide for pretraining dataset construction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.210706Z"},"links":{"cited_paper":"/paper/2407.06380","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:2363bb3040d5465f7fae7fbaf0b32ffe0c45ffa2fa29b309321fe4d885bed560","observation_id":"e6ac58fd-dcf0-4aa1-a52c-a87c69a632a3","resolution":{"observed_at":"2026-08-07T12:35:43.210706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13296","last_updated":"2024-10-30T01:04:15Z","snapshot_observed_at":"2026-08-08T06:13:30.100547Z","submitted_at":"2024-08-23T14:48:02Z","title":"The Ultimate Guide to Fine-Tuning LLMs from Basics to Breakthroughs: An Exhaustive Review of Technologies, Research, Best Practices, Applied Research Challenges and Opportunities","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13296","snapshot_observed_at":"2026-08-07T12:35:43.277388Z","title":"B., Zafar, A., Khan, A., and Shahid, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.277388Z"},"links":{"cited_paper":"/paper/2408.13296","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:8dba7919f15ff0642500bf629192d625db347763faa0dab13d74fb85d5d0ca5d","observation_id":"244660e8-c889-40d0-b79e-f02cbc813d6a","resolution":{"observed_at":"2026-08-07T12:35:43.277388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.604175Z","title":"Relating leverage scores and density using regularized christoffel functions","venue":null,"work_id":"28da1e89-75d8-4ab1-8af5-a2b1d504a9ce","year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.394425Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:330f1f77530c9cfbae96a2e043f390ea57db4de6333b50fd7d5e0beb67d1d161","observation_id":"8d059221-f8d1-4d27-9d31-2c07972dee6b","resolution":{"observed_at":"2026-08-07T12:35:47.678146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.435651Z","title":"Falkon: An optimal large scale kernel method","venue":null,"work_id":"c02ba2b9-25f6-417e-a8a6-f1d9f633eade","year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.481067Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:086cf02cd90e023754fe74c2546ccff5164b83eb2cad92fae803d3a1d88ba275","observation_id":"91ca0a5d-bda1-4d00-b818-82f9c0eae9f6","resolution":{"observed_at":"2026-08-07T12:35:47.531788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.240445Z","title":"On fast leverage score sampling and optimal learning","venue":null,"work_id":"2bad36e6-a28e-4a58-9eb8-b2c22c65e1f1","year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.550515Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:7fec6cf8d471bc10762f72b5937a4e88ed2dbc2eccd06d3aa64a605976aa2310","observation_id":"44dda75b-1c18-4e14-979b-3125ce1b0ef2","resolution":{"observed_at":"2026-08-07T12:35:47.334377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:47.098306Z","title":"W., Hashimoto, T","venue":null,"work_id":"13c5d949-5a6d-4a9e-bc54-8f005e62754c","year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.661039Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:72be74c0e177f345420229825f99c612eca93c8f062631791d44697195a822b7","observation_id":"13a410b8-2423-41a9-9932-d907f680f02e","resolution":{"observed_at":"2026-08-07T12:35:47.166816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.912509Z","title":"L., Bhagavatula, C., and Choi, Y","venue":null,"work_id":"7fb1aece-104b-41d1-93e7-b24eded165ae","year":2021},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.759872Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:5a46c8196c960a0a2302cf8ca2f5216e41a46f4c574dfb7ca9943d285c44ab02","observation_id":"a6f33091-d00f-4906-a6c2-95b580a7b1cd","resolution":{"observed_at":"2026-08-07T12:35:46.982119Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09728","last_updated":"2019-09-09T17:29:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-04-22T05:36:37Z","title":"SocialIQA: Commonsense Reasoning about Social Interactions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09728","snapshot_observed_at":"2026-08-07T12:35:43.845142Z","title":"Socialiqa: Commonsense reasoning about social interactions","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.845142Z"},"links":{"cited_paper":"/paper/1904.09728","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:49c96937f64f3348551cd0233976011e80ac4aa8019df2fbe8269f7efd71c99c","observation_id":"c9862cc0-9dbd-45ba-9ff8-878343a3146f","resolution":{"observed_at":"2026-08-07T12:35:43.845142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.743582Z","title":"Superglue: Learning feature matching with graph neural networks","venue":null,"work_id":"f469dc63-8682-474b-8f6f-ceff0cd131b9","year":2020},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:43.941226Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:b0b365a12f18f54cddf5b17508a289a285ee3865077b875d11693c1924d6343a","observation_id":"252658e2-bfaf-448a-b50b-a0d16113da04","resolution":{"observed_at":"2026-08-07T12:35:46.809132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.578270Z","title":null,"venue":null,"work_id":"11a477cb-1d6a-469f-983d-6fc5d77c5377","year":2001},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.077211Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:d31faa6681786edfedde4dff2900cf3303934ec8859d33a506c93affe9959ef0","observation_id":"dca80466-c8a3-42bc-9c43-91a16adddafc","resolution":{"observed_at":"2026-08-07T12:35:46.672149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10818","last_updated":"2024-05-09T13:56:06Z","snapshot_observed_at":"2026-08-07T23:26:20.937888Z","submitted_at":"2023-09-19T17:59:54Z","title":"SlimPajama-DC: Understanding Data Combinations for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10818","snapshot_observed_at":"2026-08-07T12:35:44.169610Z","title":"Slimpajama-dc: Understanding data combinations for llm training","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.169610Z"},"links":{"cited_paper":"/paper/2309.10818","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:cd008f16aeea6d7c1b88a343b3d9aaf6c43febc45852d5ee36e4be13864ef284","observation_id":"68de9851-dcfe-4231-a816-3a668ff1a055","resolution":{"observed_at":"2026-08-07T12:35:44.169610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.404383Z","title":"R., Hestness, J., and Dey, N","venue":null,"work_id":"968477f1-8c7a-44cd-a0ee-61f243d394de","year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.265934Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:77910dce466c32a02ad17e97c1e23d1539e09031b72239e61f8773f7accf5631","observation_id":"b5b8a180-72cf-44ca-996f-2adf63905bf7","resolution":{"observed_at":"2026-08-07T12:35:46.483514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.217894Z","title":null,"venue":null,"work_id":"13f9990c-2a4b-4f1c-88de-d1f02da4cb55","year":1999},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.370685Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:0d41caa8b32cf81e7fce5e5d21813548394f96fa448b75046aa861d7467ae260","observation_id":"260c8516-a786-4aa6-9a78-0a5b57cbb685","resolution":{"observed_at":"2026-08-07T12:35:46.303556Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:46.009184Z","title":"N., Kaiser, L","venue":null,"work_id":"f6f81f4a-6cf0-4142-8487-152f19aa6fbe","year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.430256Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:085f7291085f7de5f789b14cac824cfcede97b2ded6c56277f72110d6da77346","observation_id":"2c8a2fc8-5afd-4fb1-af99-59103a2155a1","resolution":{"observed_at":"2026-08-07T12:35:46.106489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-07-06T06:34:26.609892Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-07T12:35:44.518896Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.518896Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:07d6d8c9fde8975782565afb6cce9502286f59f136bbade216ada9655c77cf5f","observation_id":"33580535-e89e-4bd8-80f1-339ed89cfe22","resolution":{"observed_at":"2026-08-07T12:35:44.518896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-06T06:05:27.671303Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-08-07T12:35:44.600639Z","title":"F., and Gardner, M","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.600639Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:5627691b63493d52c6990b7a2fffa069273c57947e55f8086f65a73040fe9ec3","observation_id":"07c17dd7-463b-4d89-a894-286945055dbf","resolution":{"observed_at":"2026-08-07T12:35:44.600639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:45.836067Z","title":"M., Pham, H., Dong, X., Du, N., Liu, H., Lu, Y., Liang, P., Le, Q","venue":null,"work_id":"ae5e5add-0d2d-4fc2-8a6d-a968745a5af8","year":2023},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.680872Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:03431c0abd86f091fda7cc5188aae99b68fef3dbb1fbf3ac28778ae92b9a1b7f","observation_id":"3feeeabe-7f0d-4ce5-ae89-4dbf3c0c4ee5","resolution":{"observed_at":"2026-08-07T12:35:45.908361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:45.656369Z","title":"N., and Mirzasoleiman, B","venue":null,"work_id":"802e3613-8f94-43ee-8658-1fa1859e6965","year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.748439Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:18ad953e54672d876307bb0a61716370e25e77df13f138341f4d815d53944460","observation_id":"a3642873-dedc-4f25-85fd-309da848bf11","resolution":{"observed_at":"2026-08-07T12:35:45.740683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16952","last_updated":"2025-03-20T03:31:27Z","snapshot_observed_at":"2026-07-06T17:50:18.017647Z","submitted_at":"2024-03-25T17:14:00Z","title":"Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16952","snapshot_observed_at":"2026-08-07T12:35:44.851956Z","title":"Data mixing laws: Optimizing data mixtures by predicting language modeling performance","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.851956Z"},"links":{"cited_paper":"/paper/2403.16952","citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:f370cfd132ba37d9b1bb82a671729f7fce2b25392a124aa9d943035077cbeda7","observation_id":"a6e03e86-85cd-4257-912e-4fb29755758a","resolution":{"observed_at":"2026-08-07T12:35:44.851956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:35:45.510035Z","title":"H ella S wag: Can a machine really finish your sentence? In Annual Meeting of the Association for Computational Linguistics (ACL), pp.\\ 4791--4800, 2019","venue":null,"work_id":"2709aa09-ed96-459e-bb16-ee3f726a39b7","year":2019},"citing_paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:44.945688Z"},"links":{"citing_paper":"/paper/2505.24844"},"observation_digest":"sha256:492459f79efeac1291960e0027651140ad992a252d7e2978444fcaf1ef33fb1b","observation_id":"cffc16bb-1f22-4850-bad5-7542e0b0237c","resolution":{"observed_at":"2026-08-07T12:35:45.575582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.24844","last_updated":"2025-05-30T17:43:10Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:10:14.729914Z","submitted_at":"2025-05-30T17:43:10Z","title":"Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 2 inbound Pith citation observations for arXiv:2505.24844."}