{"as_of":"2026-08-11T12:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4f966d805619696b2bc1235f6b1ff4d4d6dcb1d14c1108b9f0c70f7aeaf13bd2","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T03:36:50.366757Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T22:58:30.457420Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-28T23:02:46.600053Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"cited_work":{"arxiv_id":"2507.15640","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15640","snapshot_observed_at":"2026-06-28T23:02:46.600053Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","venue":"cs.LG","work_id":"5dfd6b0b-ed40-4bce-8963-f612899d1322","year":2025},"citing_paper":{"arxiv_id":"2604.16380","last_updated":"2026-03-25T13:30:40Z","snapshot_observed_at":"2026-08-08T06:45:13.140900Z","submitted_at":"2026-03-25T13:30:40Z","title":"Data Mixing for Large Language Models Pretraining: A Survey and Outlook","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:04.958757Z"},"links":{"cited_paper":"/paper/2507.15640","citing_paper":"/paper/2604.16380"},"observation_digest":"sha256:8a223ba5a4565bd894238780a402dd43a005ac640762477affb7956fdec5fc2d","observation_id":"b4d18d1f-31a6-4df2-830c-f0b1a17f96bb","resolution":{"observed_at":"2026-05-15T00:58:25.692754Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"cited_work":{"arxiv_id":"2507.15640","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.15640","snapshot_observed_at":"2026-06-28T23:02:46.600053Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","venue":"cs.LG","work_id":"5dfd6b0b-ed40-4bce-8963-f612899d1322","year":2025},"citing_paper":{"arxiv_id":"2606.00400","last_updated":"2026-05-29T22:32:55Z","snapshot_observed_at":"2026-08-11T01:23:06.787895Z","submitted_at":"2026-05-29T22:32:55Z","title":"Dynamic Proxy-Mixing: Transferring Replay Controllers from Small to Large Models for Continual Instruction Tuning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-28T22:58:30.457420Z"},"links":{"cited_paper":"/paper/2507.15640","citing_paper":"/paper/2606.00400"},"observation_digest":"sha256:4d4aaffecde1dd2c003f0776da0e842a7581faf56aa29776b2feb1f5c1eb0621","observation_id":"7afe8a17-a524-4aef-a415-a65364d17719","resolution":{"observed_at":"2026-06-28T23:02:46.601406Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.15640/citation-record","integrity":"/paper/2507.15640/integrity","json":"/paper/2507.15640/citation-record.json","paper":"/paper/2507.15640"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1905.13319","last_updated":"2019-05-30T21:28:12Z","snapshot_observed_at":"2026-08-10T18:39:13.771066Z","submitted_at":"2019-05-30T21:28:12Z","title":"MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms","version":1},"cited_work":{"arxiv_id":"1905.13319","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.13319","snapshot_observed_at":"2026-07-03T23:39:04.460325Z","title":"MathQA: Towards Interpretable Math Word Problem Solving with Operation-Based Formalisms","venue":"cs.CL","work_id":"4539c966-2fd4-4238-88a9-60be171a99da","year":2019},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/1905.13319","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:2b69fac4867e198559a092f1fa8b458ae07a10a62ebc408be0eb95646fb228b3","observation_id":"a3a9c0b7-c808-4131-b86f-6cbd0e918322","resolution":{"observed_at":"2026-05-19T03:37:00.986337Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-02T19:23:53.535075Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":"2108.07732","doi":"10.1007/s11390-025-5518-5","metadata_source":"pith","pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Program Synthesis with Large Language Models","venue":"cs.PL","work_id":"fd241a05-03b9-4de2-9588-9d77ce176125","year":2021},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:b8a2e9ddec46e1c442d86d70af3c03b1c7b09aabe9526fa9c1881f321eea2a7f","observation_id":"2b7bf135-caaf-48df-9bce-17bbb202b5ba","resolution":{"observed_at":"2026-05-19T03:37:00.968882Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:30d970a30df00aaa866079d1b23b5ff6eef632c891853b5c4957f81993f1b898","observation_id":"26d48e42-d48d-4470-9dda-048f94cf361f","resolution":{"observed_at":"2026-05-19T03:37:00.960680Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":"1803.05457","doi":"10.1162/tacl_a_00448.https://aclanthology.org/2022.tacl-1.5","metadata_source":"pith","pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","venue":"cs.AI","work_id":"28ea1282-d657-4c61-a83c-f1249be6d6b1","year":2018},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:7392071e71d45c8be2d48261fd2c083ac1a5ca25f061a22243a2ecc6823d6e3d","observation_id":"0926377b-5bc1-460f-8703-bbcbcaaa92f2","resolution":{"observed_at":"2026-05-19T03:37:00.978034Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:be21ad88499e85c7dc814ebcce73642cbae2ca8c602f87a5cc15bd5f0ff793e8","observation_id":"a989a4fc-3fdc-4fb6-8035-5bffbc4dfd63","resolution":{"observed_at":"2026-05-19T03:37:01.000498Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13161","last_updated":"2025-11-30T07:03:40Z","snapshot_observed_at":"2026-08-08T11:46:20.080583Z","submitted_at":"2025-04-17T17:58:13Z","title":"Nemotron-CLIMB: CLustering-based Iterative Data Mixture Bootstrapping for Language Model Pre-training","version":2},"cited_work":{"arxiv_id":"2504.13161","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.13161","snapshot_observed_at":"2026-07-09T02:55:53.506375Z","title":"Nemotron-climb: Clustering-based iterative data mixture bootstrap- ping for language model pre-training","venue":"cs.CL","work_id":"412269c2-ec20-4706-8440-3bb6773c3fc0","year":2025},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2504.13161","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:12eb6c1fff8f16ba30e7847621e76465e7ae5784a88e3ed596f383371bbfdc06","observation_id":"2e9e6f29-9c3f-4849-8ca7-0cef131f79e1","resolution":{"observed_at":"2026-06-23T21:14:41.072420Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":"2101.00027","doi":"10.1117/1.jmi.10.6.061104","metadata_source":"pith","pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","venue":"cs.CL","work_id":"9b10667a-da61-4358-aceb-10578234d45d","year":2020},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:992bd1b95e1103cdf39a2505fef2dd835c5b16001501388439b7dd39726822ab","observation_id":"35e013b5-9cd6-4fb6-a18d-c400a2d4437f","resolution":{"observed_at":"2026-05-19T03:37:01.011108Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv e-prints (2024), arXiv–2407","venue":null,"work_id":"0e0151fe-eae4-4d69-8924-1b6671aea777","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:dd49686ab6024af81122b5461b200c5bb3dd19e78835be0e29d1d1fb1bd2d390","observation_id":"5af74b4a-6e58-4d09-95e4-d3864b348354","resolution":{"observed_at":"2026-05-19T03:37:01.307023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":"2401.14196","doi":"10.48550/arxiv.2401.14196","metadata_source":"pith","pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","venue":"cs.SE","work_id":"f22dae5a-27e2-41d0-a061-c4286418dee3","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:64f614754f614e907283f2ee77841a81021dc7284aea35fcc325e724ce74ede8","observation_id":"199131d0-988c-49d9-a6d2-87bffb20f3b2","resolution":{"observed_at":"2026-05-19T03:37:00.937165Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T06:20:38.664414+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T06:20:38.664414+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:8a044384871053f070ec722a516ed2325d19efc3a25886fb7e3241f922fb6494","observation_id":"d1a28232-1cf4-458d-a6ca-62aac7a07064","resolution":{"observed_at":"2026-05-19T03:37:00.881795Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:06.256034+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":"2103.03874","doi":"10.48550/arxiv.2103.03874","metadata_source":"pith","pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","venue":"cs.LG","work_id":"50652ac6-fb7c-4675-a2c2-159c241feb17","year":2021},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:825580c63cfbfe4c6cb0ecd32e580d00253c24f1f0ae90c5cbb426489c364e44","observation_id":"7575a223-e476-42ec-8d1f-6ad03cd7ab03","resolution":{"observed_at":"2026-05-19T03:37:00.875458Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:22.649941+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.11143","last_updated":"2025-10-09T12:22:46Z","snapshot_observed_at":"2026-07-31T12:28:37.704994Z","submitted_at":"2024-05-20T01:04:40Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","version":6},"cited_work":{"arxiv_id":"2405.11143","doi":"10.48550/arxiv.2405.11143","metadata_source":"pith","pith_arxiv_id":"2405.11143","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework","venue":"cs.AI","work_id":"70fa48c9-2f84-49f6-9aca-37476e021fc3","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2405.11143","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:ebb16cd45f82e638cd134505a2abbd97df466ecaf8898dfa89d71165d33a310a","observation_id":"a9522292-870d-402f-8ac5-aa94298ae1d6","resolution":{"observed_at":"2026-05-19T03:37:01.005657Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":"2409.12186","doi":"10.48550/arxiv.2409.12186","metadata_source":"pith","pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Coder Technical Report","venue":"cs.CL","work_id":"09ba463d-6377-4017-9801-444ffb94b056","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:1e6720f2a912f5684a6aa2d008cd8234fefda17ef78829fbcbf352b882d752a9","observation_id":"96651f57-00e9-467f-8d5b-b90fd9e635b0","resolution":{"observed_at":"2026-05-19T03:37:00.907822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems 37 (2024), 36602–36633","venue":null,"work_id":"5ae204fd-b2e0-4f4b-8690-60e7e07e7aee","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:debd8255c1099d97c56adf327ef8474fee29f1a560dd173e1c094d2c8a2dfc85","observation_id":"b8bea879-61bd-4527-b38d-abf674b9f08b","resolution":{"observed_at":"2026-05-19T03:37:01.343116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems 33 (2020), 1179–1191","venue":null,"work_id":"3885a8cf-c525-4f05-920d-f587ecb137c6","year":2020},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:788a354ab0dd9c7ac0dca5b6466c07ee94c1126162a61c8191b5125537f2ae7f","observation_id":"45a106a5-7b8f-4db1-b44e-da2cde1f578f","resolution":{"observed_at":"2026-05-19T03:37:01.338197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hao Li, Bowen Deng, Chang Xu, Zhiyuan Feng, Viktor Schlegel, Yu-Hao Huang, Yizheng Sun, Jingyuan Sun, Kailai Yang, Yiyao Yu, et al","venue":null,"work_id":"433346c1-4cfb-46e7-b1f1-f646ac3e01ea","year":2022},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:b922fae1ce44441f7a669377c52e89b66624282ef5ad673b4b4615821d0eb775","observation_id":"8bb39d41-8813-4b6a-a046-a6c5129f5b5c","resolution":{"observed_at":"2026-05-19T03:37:01.347822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.07584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T22:27:26.122883Z","title":"MIRA: Medical time series foundation model for real-world health data","venue":null,"work_id":"58197080-4f9d-4529-a5ba-6e7196c0eb57","year":2025},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:2012f85e08702ae60b2d64042e7383402cd8a4abcce278a93a7053154fedc53e","observation_id":"04c63033-6f1f-46a8-a936-7c22b5e90363","resolution":{"observed_at":"2026-05-19T03:37:00.942105Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems 37 (2024), 14200–14282","venue":null,"work_id":"45679ff1-7e6d-4298-afdd-579f3c05b505","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:4d3dcfc66c49246011aeffca8fbc140af045c7984f25d4d878e6fb1d5cc56223","observation_id":"d89057f2-fe4f-4d00-b34f-03591fad68e1","resolution":{"observed_at":"2026-05-19T03:37:01.310171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13629","last_updated":"2025-02-10T17:19:21Z","snapshot_observed_at":"2026-08-11T11:09:19.365931Z","submitted_at":"2025-01-23T12:58:14Z","title":"Sigma: Differential Rescaling of Query, Key and Value for Efficient Language Models","version":2},"cited_work":{"arxiv_id":"2501.13629","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.13629","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2501.13629 (2025)","venue":null,"work_id":"66f50064-271f-4fc5-be2d-b74e00e6543c","year":2025},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2501.13629","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:9b91edcab6343c69bfa64ebb7517a4d137e1c378e774b975401e8c350de7cbcc","observation_id":"52228e1e-b7f4-4c6d-8b9c-bc7f199c4f61","resolution":{"observed_at":"2026-05-19T03:37:00.948390Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08124","last_updated":"2020-07-16T05:52:16Z","snapshot_observed_at":"2026-08-10T13:06:17.421919Z","submitted_at":"2020-07-16T05:52:16Z","title":"LogiQA: A Challenge Dataset for Machine Reading Comprehension with Logical Reasoning","version":1},"cited_work":{"arxiv_id":"2007.08124","doi":"10.48550/arxiv.2007.08124","metadata_source":"arxiv_reference","pith_arxiv_id":"2007.08124","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2007.08124 (2020)","venue":"arXiv (Cornell University)","work_id":"32452451-f619-44d7-b8e3-a44f4ef1d284","year":2007},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2007.08124","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:c6e365fe569b58e0a3eb938af01d3c0b8582cc60099bb88ceafc1613bc8febe5","observation_id":"c97fe844-30c1-40d2-a40e-60dd0a2e50d7","resolution":{"observed_at":"2026-05-19T03:37:00.973148Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08747","last_updated":"2025-01-05T04:09:00Z","snapshot_observed_at":"2026-08-10T01:52:30.559515Z","submitted_at":"2023-08-17T02:53:23Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","version":5},"cited_work":{"arxiv_id":"2308.08747","doi":"10.48550/arxiv.2308.08747","metadata_source":"pith","pith_arxiv_id":"2308.08747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Empirical Study of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning","venue":"cs.CL","work_id":"3e52a549-8994-4fc0-921b-ae16d32f1acc","year":2023},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2308.08747","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:d7fb56ba438bdd35e31fae141f7b864578bc4245dcd9d46c2ef709a092fe5c5a","observation_id":"cef4154c-5bd3-411d-b69e-0ec0a114679b","resolution":{"observed_at":"2026-05-19T03:37:00.990682Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14318","last_updated":"2025-05-20T15:09:35Z","snapshot_observed_at":"2026-08-09T13:36:44.241473Z","submitted_at":"2024-11-21T17:10:02Z","title":"Velocitune: A Velocity-based Dynamic Domain Reweighting Method for Continual Pre-training","version":2},"cited_work":{"arxiv_id":"2411.14318","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.14318","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2411.14318 (2024)","venue":null,"work_id":"fd2371ca-fe70-40f1-88ec-bf67f131275b","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2411.14318","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:0bc00aa27773e9ed1389f0eb4569f34c11916e61ae6bd6f361880bdb2078ca3e","observation_id":"87026fe1-9069-4bff-970a-1a075510265e","resolution":{"observed_at":"2026-05-19T03:37:00.887186Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02789","last_updated":"2018-09-08T11:47:16Z","snapshot_observed_at":"2026-08-08T02:19:52.596062Z","submitted_at":"2018-09-08T11:47:16Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","version":1},"cited_work":{"arxiv_id":"1809.02789","doi":"10.48550/arxiv.1809.02789","metadata_source":"pith","pith_arxiv_id":"1809.02789","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Can a Suit of Armor Conduct Electricity? A New Dataset for Open Book Question Answering","venue":"cs.CL","work_id":"b9d68fc0-5b23-4def-bc5e-6ad71d64eec6","year":2018},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/1809.02789","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:8580d4aabbc8020e205bb8646bb270b73ab3e44ce78f211643161951565e8b67","observation_id":"a46c3f75-e7cb-4b91-87c1-2f2d7a082dbb","resolution":{"observed_at":"2026-05-19T03:37:00.903187Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00656","last_updated":"2025-10-08T07:50:45Z","snapshot_observed_at":"2026-08-08T06:58:44.493777Z","submitted_at":"2024-12-31T21:55:10Z","title":"2 OLMo 2 Furious","version":3},"cited_work":{"arxiv_id":"2501.00656","doi":"10.48550/arxiv.2501.00656","metadata_source":"pith","pith_arxiv_id":"2501.00656","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2 OLMo 2 Furious","venue":"cs.CL","work_id":"9ef0dc2b-fdfe-4f14-b235-ef7556dc709a","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2501.00656","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:7fa950ba81b5971350cdc5bd414ff46818b8cef7a42a43986c98002d4d3f2d20","observation_id":"ff554539-dc20-46a0-b969-8b611b068b72","resolution":{"observed_at":"2026-05-19T03:37:00.892082Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:19:24.20254+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems 37 (2024), 30811–30849","venue":null,"work_id":"11676dbd-18f1-4130-85cd-5084b4481c2d","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:06ac2bca9111a2984ab9e4b4d196660cbf8dbae131ba19eaa2e1a4b3b3b685ac","observation_id":"964763d7-7665-4605-b7d1-b9253395f328","resolution":{"observed_at":"2026-05-19T03:37:01.333750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15556","last_updated":"2025-01-26T15:12:06Z","snapshot_observed_at":"2026-08-10T14:08:22.206644Z","submitted_at":"2025-01-26T15:12:06Z","title":"Commute Your Domains: Trajectory Optimality Criterion for Multi-Domain Learning","version":1},"cited_work":{"arxiv_id":"2501.15556","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.15556","snapshot_observed_at":"2026-07-04T16:49:58.057648Z","title":"arXiv preprint arXiv:2501.15556 (2025)","venue":null,"work_id":"a8c150a2-efaf-4826-a35a-9fcf6787d234","year":2025},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2501.15556","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:57b103542652d2aa8bd0901800e64cdd1af0c253de27d51446e648e0c0e7398b","observation_id":"66f08c25-4762-406d-b8a7-017d9b59a568","resolution":{"observed_at":"2026-05-19T03:37:00.912798Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.08731","last_updated":"2020-04-02T05:40:29Z","snapshot_observed_at":"2026-08-02T19:28:48.954133Z","submitted_at":"2019-11-20T06:43:41Z","title":"Distributionally Robust Neural Networks for Group Shifts: On the Importance of Regularization for Worst-Case Generalization","version":2},"cited_work":{"arxiv_id":"1911.08731","doi":"10.48550/arxiv.1911.08731","metadata_source":"pith","pith_arxiv_id":"1911.08731","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Distributionally Robust Neural Networks for Group Shifts: On the Importance of Regularization for Worst-Case Generalization","venue":"cs.LG","work_id":"b9385d0d-bafd-43d3-8948-4d2da8ee27a0","year":2019},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/1911.08731","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:065274aaab630874e14f183c40248794b221c090f9a3748616d109bb856a8d4a","observation_id":"f5214a59-f493-484c-a3a1-dd9eec1572bb","resolution":{"observed_at":"2026-05-19T03:37:00.923093Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"95d99670-8ffa-4683-92f6-5faad71e6212","year":2021},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:28b609b80a22689c9f10f0cf71095c5e9b1bc7f34b1d358337a057863c8fd71c","observation_id":"33cf8c51-acbb-4bb2-b3f0-37d04b275531","resolution":{"observed_at":"2026-05-19T03:37:01.300191Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Journal of Machine Learning Research 23, 315 (2022), 1–20","venue":null,"work_id":"efcce0bf-d254-4e0c-aeeb-753b4ab1f8c8","year":2022},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:69f69d7a9fa6d1a41005bd1b25bfa6627123b24dc932e075a22878b379d9a861","observation_id":"a35dd49b-c5e4-4839-8fda-7ec64fadfe46","resolution":{"observed_at":"2026-05-19T03:37:01.326175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:4943c6f62b80145513f11368eb644c12f558b2fbdee69929e787d07abf70a4dc","observation_id":"d331afd4-3c37-47cd-a4fd-0c3aea5c7808","resolution":{"observed_at":"2026-05-19T03:37:00.982268Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10818","last_updated":"2024-05-09T13:56:06Z","snapshot_observed_at":"2026-08-07T23:26:20.937888Z","submitted_at":"2023-09-19T17:59:54Z","title":"SlimPajama-DC: Understanding Data Combinations for LLM Training","version":3},"cited_work":{"arxiv_id":"2309.10818","doi":"10.48550/arxiv.2309.10818","metadata_source":"arxiv_reference","pith_arxiv_id":"2309.10818","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Xing , title =","venue":"arXiv (Cornell University)","work_id":"d4330bb0-2cd0-4a69-aa23-53ec4cd66b4d","year":2023},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2309.10818","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:93f625361b02a5514025e6ea60115d268d64b6e05694f0bc7d9d4c802b552ce6","observation_id":"1deba2ba-5f51-4663-bb29-9ef5b9b2f998","resolution":{"observed_at":"2026-05-19T03:37:00.952584Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-24T05:54:41.460759+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T05:54:41.460759+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"99d090ab-1ff1-458a-bb20-9b221d4bf0c0","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:76481046b7b036f178fe600d5f4b9377d96068917bd56f60da1929d40163f2d6","observation_id":"5d2f377c-85ca-4a7a-a6e4-2d4c0f74f2a1","resolution":{"observed_at":"2026-05-19T03:37:01.329742Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08053","last_updated":"2020-03-13T23:45:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2019-09-17T19:42:54Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","version":4},"cited_work":{"arxiv_id":"1909.08053","doi":"10.48550/arxiv.1909.08053","metadata_source":"pith","pith_arxiv_id":"1909.08053","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Megatron-LM: Training Multi-Billion Parameter Language Models Using Model Parallelism","venue":"cs.CL","work_id":"c888e6d1-0b1d-43d6-9ef5-f0912a0efa1b","year":2019},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/1909.08053","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:f409983a8b67e82236f821f97edcb2acbc4e15f76ee3e82012e2610d4b256e3b","observation_id":"750ca42e-09b8-4e63-b44a-5a3822f002b0","resolution":{"observed_at":"2026-05-19T03:37:00.897231Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-09T10:48:33.392193+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.02595","last_updated":"2025-05-30T20:49:42Z","snapshot_observed_at":"2026-08-04T07:58:32.632698Z","submitted_at":"2024-12-03T17:28:50Z","title":"Nemotron-CC: Transforming Common Crawl into a Refined Long-Horizon Pretraining Dataset","version":2},"cited_work":{"arxiv_id":"2412.02595","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02595","snapshot_observed_at":"2026-07-02T17:47:18.026339Z","title":"Nemotron-cc: Transforming common crawl into a refined long-horizon pretraining dataset.arXiv preprint arXiv:2412.02595","venue":null,"work_id":"bab220a8-ec16-4f03-9452-4eb35d618607","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2412.02595","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:6e8c234cdd041784eacf95b687d5181952fdfadfe1090755e3805bd094a64581","observation_id":"7b1a5429-0f19-4ade-962c-c996430c7295","resolution":{"observed_at":"2026-05-19T03:37:00.956871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems 12 (1999)","venue":null,"work_id":"81ac6aa8-65bd-4911-a873-34bbb2292f99","year":1999},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:5bce0f389cd24d0ac9bec66aaa033b8470a59537695c37870b8a343966ee5e21","observation_id":"40dcc835-8a72-4207-8163-52dded710155","resolution":{"observed_at":"2026-05-19T03:37:01.313603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nejm Ai 1, 3 (2024), AIoa2300138","venue":null,"work_id":"ad25307f-8e56-4ebb-8b30-9528657986b8","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:c157cb4dfb9dd34c8d9f087d557b280d99cd36e3a0f208b4e835823079b67490","observation_id":"9e10026e-33f8-4810-88ee-1776cca61178","resolution":{"observed_at":"2026-05-19T03:37:01.323049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in neural information processing systems 30 (2017)","venue":null,"work_id":"8b16bcf2-a52f-4c0d-bc32-b046e88a3500","year":2017},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:09ecaddebe4fdb1ab9d3fd06956652582d586a4d6944512127497f17ef17d5df","observation_id":"d15d1679-8b1f-4ea8-ae83-e0882d2660eb","resolution":{"observed_at":"2026-05-19T03:37:01.303965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03731","last_updated":"2023-10-05T17:52:09Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:52:09Z","title":"MathCoder: Seamless Code Integration in LLMs for Enhanced Mathematical Reasoning","version":1},"cited_work":{"arxiv_id":"2310.03731","doi":"10.48550/arxiv.2310.03731","metadata_source":"arxiv_reference","pith_arxiv_id":"2310.03731","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mathcoder: Seamless code integration in llms for enhanced mathematical reasoning","venue":"arXiv (Cornell University)","work_id":"36308722-f027-40ce-b4e0-8d2c26bb0f9e","year":2023},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2310.03731","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:26561c706d058f25703efa942b86b4980a48725e7f32aa90d7d563b2dc416d86","observation_id":"157072b1-a794-49b1-be32-eda0a6466340","resolution":{"observed_at":"2026-05-19T03:37:00.864495Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06209","last_updated":"2017-07-19T17:28:46Z","snapshot_observed_at":"2026-08-06T06:05:27.671303Z","submitted_at":"2017-07-19T17:28:46Z","title":"Crowdsourcing Multiple Choice Science Questions","version":1},"cited_work":{"arxiv_id":"1707.06209","doi":null,"metadata_source":"pith","pith_arxiv_id":"1707.06209","snapshot_observed_at":"2026-07-04T00:59:20.987277Z","title":"Crowdsourcing Multiple Choice Science Questions","venue":"cs.HC","work_id":"d186f73e-dc39-4d8f-9c07-fb134a60433d","year":2017},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/1707.06209","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:734941f582dcedc78b5ee62164ef787490a21af4b8e52e96c08edd868c1e85f6","observation_id":"12d671f4-7f03-472e-9629-f343d80bb0eb","resolution":{"observed_at":"2026-05-19T03:37:00.845918Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10341","last_updated":"2025-07-16T07:09:29Z","snapshot_observed_at":"2026-08-07T18:25:04.873435Z","submitted_at":"2025-02-14T18:02:37Z","title":"Organize the Web: Constructing Domains Enhances Pre-Training Data Curation","version":3},"cited_work":{"arxiv_id":"2502.10341","doi":"10.48550/arxiv.2502.10341","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.10341","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2502.10341 (2025)","venue":"ArXiv.org","work_id":"abfd649b-44bc-4704-8969-8aa7cf4cfb37","year":2025},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2502.10341","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:5db68a13f784d77503603ac34eff94c98bee52eb0595eafb4f3a280e0ad9da5c","observation_id":"029de565-8692-436c-b5ae-74ea460722e9","resolution":{"observed_at":"2026-05-19T03:37:01.021457Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01506","last_updated":"2025-03-03T13:22:11Z","snapshot_observed_at":"2026-08-07T17:33:46.644445Z","submitted_at":"2025-03-03T13:22:11Z","title":"SampleMix: A Sample-wise Pre-training Data Mixing Strategey by Coordinating Data Quality and Diversity","version":1},"cited_work":{"arxiv_id":"2503.01506","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.01506","snapshot_observed_at":"2026-07-03T16:48:39.379570Z","title":"arXiv preprint arXiv:2503.01506 (2025)","venue":null,"work_id":"04f06bde-5ee5-43a7-8391-0eb2e57130be","year":2025},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2503.01506","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:5052fd3d4cd4d53c4ba7dfb3e46a6f3d576611abee463727eb0b8b0d3d78d495","observation_id":"6bd1b527-3512-4a1a-b644-0e9a6f68e480","resolution":{"observed_at":"2026-05-19T03:37:01.016522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06694","last_updated":"2024-04-11T01:18:06Z","snapshot_observed_at":"2026-08-08T20:21:38.269492Z","submitted_at":"2023-10-10T15:13:30Z","title":"Sheared LLaMA: Accelerating Language Model Pre-training via Structured Pruning","version":2},"cited_work":{"arxiv_id":"2310.06694","doi":"10.48550/arxiv.2310.06694","metadata_source":"pith","pith_arxiv_id":"2310.06694","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2310.06694 (2023)","venue":"cs.CL","work_id":"73480081-43d5-42f8-b23e-1d3638244364","year":2023},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2310.06694","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:577e6340a1bc5ccde6526157074e464c78612d0bb925d3a2058e3bc5c081487d","observation_id":"f9d93d22-e622-4fc8-9916-ad1c94f527c4","resolution":{"observed_at":"2026-05-19T03:37:00.995326Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems 37 (2024), 95716–95743","venue":null,"work_id":"4886f247-d69e-4a31-8e69-fd42ed41e610","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:e7c606730cdebdc5fc5baf2d03be209d8c25d66368b444c5b0320b123c9e9d6e","observation_id":"04f19553-c148-40c1-aabb-20418dc09acb","resolution":{"observed_at":"2026-05-19T03:37:01.320173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems 36 (2023), 69798–69818","venue":null,"work_id":"2d8af4b8-46d1-4c00-aa83-a3937badb656","year":2023},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:7e25111cee69472a9af4a41964f2b0116ef24282c5e6e7e8eae23cfacc1e0c09","observation_id":"e5b03649-3cf5-403c-9f3b-2b19a36999bd","resolution":{"observed_at":"2026-05-19T03:37:01.316795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:f3f18f6242d2d61806e3007a9066032fbd305837c31450fe10896188c7455167","observation_id":"52c7f777-7548-4ae3-9a72-aabaccc63335","resolution":{"observed_at":"2026-05-19T03:37:00.870067Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":"2409.12122","doi":"10.18653/v1/2025.emnlp-main.712","metadata_source":"pith","pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","venue":"cs.CL","work_id":"a097c5d4-6d32-46ee-9826-57d532bbfc9c","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:4a4741493eab9b92c83003749b06ed3225c85ff14b7568ca0f19a121d049e7a3","observation_id":"7f9a4a78-9bc0-4519-95c9-5fcd9ad9b027","resolution":{"observed_at":"2026-05-19T03:37:00.917537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16952","last_updated":"2025-03-20T03:31:27Z","snapshot_observed_at":"2026-07-06T17:50:18.017647Z","submitted_at":"2024-03-25T17:14:00Z","title":"Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance","version":2},"cited_work":{"arxiv_id":"2403.16952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.16952","snapshot_observed_at":"2026-07-04T16:19:57.811085Z","title":"Data mixing laws: Optimizing data mixtures by predicting language modeling performance","venue":null,"work_id":"bae2fa4c-1471-459e-9a6f-e1d7f0b200c2","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2403.16952","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:67690de80d9c2f72b1d468a9c8a9bb350f0302a0d77120c1b117ce46383ad009","observation_id":"a2699ca4-c700-4482-b3f7-f4859ccf8536","resolution":{"observed_at":"2026-05-19T03:37:00.829310Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-02T15:00:50.388422Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":"2309.12284","doi":"10.48550/arxiv.2309.12284","metadata_source":"pith","pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","venue":"cs.CL","work_id":"e791a2f0-3b75-4c5b-84e1-d297d96e42f0","year":2023},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:5dc07c2d76260793c26cb4c5212baee04cb73ab4076d763900216ea97a54fdb4","observation_id":"443b2f42-9b08-4ab9-9e70-1fa93b354cf9","resolution":{"observed_at":"2026-05-19T03:37:00.932991Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-10T16:18:23.994244Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":"1905.07830","doi":"10.48550/arxiv.1905.07830","metadata_source":"pith","pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","venue":"cs.CL","work_id":"79f44c0c-96f4-4edb-bc50-a3c9d6b85936","year":2019},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:1f25e83f4a5148dc41b92aa5d7493aebad9787f4b5bd3bdd7f727556fb07b1b6","observation_id":"e9b0b7e4-9300-4e7b-be1f-9814b73db33c","resolution":{"observed_at":"2026-05-19T03:37:00.964918Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01801","last_updated":"2024-05-06T20:48:41Z","snapshot_observed_at":"2026-08-10T14:09:11.445183Z","submitted_at":"2024-02-02T07:24:35Z","title":"Large Language Models for Time Series: A Survey","version":3},"cited_work":{"arxiv_id":"2402.01801","doi":"10.48550/arxiv.2402.01801","metadata_source":"arxiv_reference","pith_arxiv_id":"2402.01801","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R., Gupta , R","venue":"arXiv (Cornell University)","work_id":"bee3da43-6433-4d89-b2a5-d0068481cfdb","year":2024},"citing_paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-19T03:36:50.366757Z"},"links":{"cited_paper":"/paper/2402.01801","citing_paper":"/paper/2507.15640"},"observation_digest":"sha256:2586c9fca50c5d908a3e82c34e019d3e756823dceb6d158de29abca0b1621a96","observation_id":"3c0b2544-c85c-4e99-b096-e4a5b444ee91","resolution":{"observed_at":"2026-05-19T03:37:00.858436Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-22T12:22:41.957764+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T12:22:41.957764+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.15640","last_updated":"2026-04-12T09:28:58Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T03:59:56.664513Z","submitted_at":"2025-07-21T14:01:54Z","title":"Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":26,"parse_uncertain":0,"unresolved":2,"verified_exact":10,"verified_fuzzy":12},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 2 inbound Pith citation observations for arXiv:2507.15640."}