{"as_of":"2026-08-16T11:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e527ae52904782eaff1fbec00d54c2c29cd5d347b8bd6e21b75bd2372c50c438","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:32:06.138481Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T00:56:04.958757Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T00:58:25.715789Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"cited_work":{"arxiv_id":"2505.12762","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.12762","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ideal: Data equilibrium adaptation for multi-capability language model alignment","venue":null,"work_id":"b2846a0c-0a43-434a-81a2-81506992444d","year":2025},"citing_paper":{"arxiv_id":"2604.16380","last_updated":"2026-03-25T13:30:40Z","snapshot_observed_at":"2026-08-15T22:16:01.152280Z","submitted_at":"2026-03-25T13:30:40Z","title":"Data Mixing for Large Language Models Pretraining: A Survey and Outlook","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-15T00:56:04.958757Z"},"links":{"cited_paper":"/paper/2505.12762","citing_paper":"/paper/2604.16380"},"observation_digest":"sha256:aae0f6525b5825c47e8ca0538dd13905b0c66563b6b4bf78fb6adff6957ecf28","observation_id":"007d0d6e-ed1f-4ae1-9b7e-1482812f202c","resolution":{"observed_at":"2026-05-15T00:58:25.717361Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.12762/citation-record","integrity":"/paper/2505.12762/integrity","json":"/paper/2505.12762/citation-record.json","paper":"/paper/2505.12762"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.04425","last_updated":"2025-03-20T02:52:47Z","snapshot_observed_at":"2026-08-13T13:02:04.299958Z","submitted_at":"2024-11-07T04:38:29Z","title":"DELIFT: Data Efficient Language model Instruction Fine Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04425","snapshot_observed_at":"2026-08-15T20:32:05.916418Z","title":"Agarwal, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.916418Z"},"links":{"cited_paper":"/paper/2411.04425","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:3145d4cd84e07c970b6c1b25a0e77159c64e18672ac8cb24e3bac466d05859d5","observation_id":"bc8ec63b-f5a4-4240-87c5-f2f3f2976f51","resolution":{"observed_at":"2026-08-15T20:32:05.916418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16827","last_updated":"2024-08-02T17:59:31Z","snapshot_observed_at":"2026-08-15T10:00:03.235901Z","submitted_at":"2024-02-26T18:54:35Z","title":"A Survey on Data Selection for Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16827","snapshot_observed_at":"2026-08-15T20:32:05.920871Z","title":"Albalak, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.920871Z"},"links":{"cited_paper":"/paper/2402.16827","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:0a03ffec01dee2064aeb35acf7c6e80e3199fd72a7dd96095f6caa00a4788a75","observation_id":"626545fd-77c1-4583-a20d-61d0397a04dd","resolution":{"observed_at":"2026-08-15T20:32:05.920871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.790901Z","title":"The claude 3 model family: Opus, sonnet, haiku","venue":null,"work_id":"eab15ca5-93b0-4d41-a3cb-4af891abc41c","year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.924571Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:4fd08eb40501a0f3e6061c1f0d9fb59984efe6c3d05364bb9c4b2d697151823e","observation_id":"d4e983ed-bc7a-413e-8cc9-3709d014b623","resolution":{"observed_at":"2026-08-15T20:32:06.794206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-15T20:32:05.930955Z","title":"Austin, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.930955Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:04220938e802e498ee0eee7b61b9663a1d800862f7fe8a3d1139b675611c1acd","observation_id":"8be3106b-d622-4075-9ea2-36e5248f72f5","resolution":{"observed_at":"2026-08-15T20:32:05.930955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:05.933955Z","title":"Bengio, J","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.933955Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:d4e6814ba8d06cdfeeb3c32fadd0efd3879e93583d0190346b77a05664961f8e","observation_id":"c981621f-a9f6-45e3-aae9-79cdb4ecc56b","resolution":{"observed_at":"2026-08-15T20:32:05.933955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.775604Z","title":null,"venue":null,"work_id":"fc0858ea-c66c-410c-8dae-e86eee0cf205","year":2021},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.937373Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:f02ee3b72a00c652e03092f1d301da283736d17f4e7fed8325b2f2910b261897","observation_id":"daeb8c75-cce4-4b82-af38-e386a234b812","resolution":{"observed_at":"2026-08-15T20:32:06.778746Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14270","last_updated":"2024-03-01T15:21:16Z","snapshot_observed_at":"2026-08-15T21:39:21.019997Z","submitted_at":"2024-02-22T04:10:57Z","title":"Take the Bull by the Horns: Hard Sample-Reweighted Continual Training Improves LLM Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14270","snapshot_observed_at":"2026-08-15T20:32:05.940394Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.940394Z"},"links":{"cited_paper":"/paper/2402.14270","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:634d0c3ee1bb53d660383eb173ed3be71da0a1fb269bef30370fdae01cb4d332","observation_id":"dce06d90-89af-4d3d-977e-478e2ce3795d","resolution":{"observed_at":"2026-08-15T20:32:05.940394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09151","last_updated":"2023-04-18T17:45:50Z","snapshot_observed_at":"2026-08-15T20:10:38.132908Z","submitted_at":"2023-04-18T17:45:50Z","title":"UniMax: Fairer and more Effective Language Sampling for Large-Scale Multilingual Pretraining","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09151","snapshot_observed_at":"2026-08-15T20:32:05.943513Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.943513Z"},"links":{"cited_paper":"/paper/2304.09151","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:23080ba1ee8a174e94057bca3c1e62d0ad9b70f849df80258f6a8a4c0d37cd21","observation_id":"5a1604d0-71ad-4c33-ae1a-156ae6de2079","resolution":{"observed_at":"2026-08-15T20:32:05.943513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-15T20:32:05.947697Z","title":"Clark, I","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.947697Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:15abef16839c8f625fb6ab0672be243dcebd7ded708a8a128570a17cc3467134","observation_id":"c76b2c8f-756c-46af-ad5b-55240cde1288","resolution":{"observed_at":"2026-08-15T20:32:05.947697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T20:32:05.951626Z","title":"Cobbe, V","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.951626Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:6863673f69bf34971d27ce75067bb58486c44f79b962e24c8e8785b3e1bc0e16","observation_id":"0c74731e-da5b-4184-b158-210cc6cc86a5","resolution":{"observed_at":"2026-08-15T20:32:05.951626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.765312Z","title":"Contributors","venue":null,"work_id":"eed1abbc-5303-4af8-82f1-31bc42b27635","year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.954779Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:53525ce0478a3ccbef75a5eb8604d648a3873bf998ca0e767ac472f6981b85a4","observation_id":"bf909082-e51a-4af4-99d7-a193eb50c8f5","resolution":{"observed_at":"2026-08-15T20:32:06.768925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.754689Z","title":"Dehaerne, B","venue":null,"work_id":"e7fba2be-0740-45c6-83d1-d4626345c931","year":2022},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.957747Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:e55533300fa01945de7437d65c120442ee606b3de02a84dd08b8824cfd7ef1d0","observation_id":"057cdc3c-6202-46a5-b583-e4002dc342c6","resolution":{"observed_at":"2026-08-15T20:32:06.758190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05492","last_updated":"2024-06-07T15:51:08Z","snapshot_observed_at":"2026-08-13T05:54:09.385656Z","submitted_at":"2023-10-09T07:56:16Z","title":"How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05492","snapshot_observed_at":"2026-08-15T20:32:05.960690Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.960690Z"},"links":{"cited_paper":"/paper/2310.05492","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:81049938fa2871e076773a67f55a5c79a3910a403780761764f4295e182c21a2","observation_id":"e9354517-c7fe-4001-b768-18715b220769","resolution":{"observed_at":"2026-08-15T20:32:05.960690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12926","last_updated":"2024-01-23T17:22:00Z","snapshot_observed_at":"2026-08-14T22:48:37.779320Z","submitted_at":"2024-01-23T17:22:00Z","title":"DsDm: Model-Aware Dataset Selection with Datamodels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12926","snapshot_observed_at":"2026-08-15T20:32:05.963735Z","title":"Engstrom, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.963735Z"},"links":{"cited_paper":"/paper/2401.12926","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:9991f5a7b090a5872280b5daa9639b36f5f75ef77d827f07cf83a6e095c00b87","observation_id":"e1388cf8-556b-424e-93d5-645c67002203","resolution":{"observed_at":"2026-08-15T20:32:05.963735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15393","last_updated":"2024-02-05T16:33:05Z","snapshot_observed_at":"2026-08-14T22:09:51.012352Z","submitted_at":"2023-10-23T22:51:58Z","title":"DoGE: Domain Reweighting with Generalization Estimation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15393","snapshot_observed_at":"2026-08-15T20:32:05.967072Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.967072Z"},"links":{"cited_paper":"/paper/2310.15393","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:f9d986f1fb17b2e81fe932a47fe3e20505bf98c27d3e5b38d144100db92d6a41","observation_id":"f442e621-206a-46b8-b33f-8ee910869b57","resolution":{"observed_at":"2026-08-15T20:32:05.967072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.20644","last_updated":"2025-04-29T11:13:18Z","snapshot_observed_at":"2026-08-16T05:21:46.500638Z","submitted_at":"2025-04-29T11:13:18Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","version":1},"cited_work":{"arxiv_id":"2504.20644","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.20644","snapshot_observed_at":"2026-08-15T20:32:06.496955Z","title":"Combatting Dimensional Collapse in LLM Pre-Training Data via Diversified File Selection","venue":"cs.LG","work_id":"f9d84246-36a7-45e1-9bdb-ea71584c2236","year":2025},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.970530Z"},"links":{"cited_paper":"/paper/2504.20644","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:532de503ee42fa183b21d6d8ce41400aad79acdac14a9876a7f2bb034866884d","observation_id":"b839afd9-f0c3-4f79-9ec9-714f2ee31a41","resolution":{"observed_at":"2026-08-15T20:32:06.502408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.744620Z","title":"Franceschelli and M","venue":null,"work_id":"8e2aafe6-4f80-4cbd-9f80-865024aa5132","year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.973643Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:41e56cf63075dbe2ad747a99a82ae4344ff47622566fd06badb1d3f7a29606ff","observation_id":"ca4b0baf-7c8f-4030-9085-d3a3ac693c94","resolution":{"observed_at":"2026-08-15T20:32:06.747924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05283","last_updated":"2024-10-11T20:10:53Z","snapshot_observed_at":"2026-08-12T22:48:59.629700Z","submitted_at":"2024-09-09T02:28:53Z","title":"On the Relationship between Truth and Political Bias in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05283","snapshot_observed_at":"2026-08-15T20:32:05.976913Z","title":"Fulay, W","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.976913Z"},"links":{"cited_paper":"/paper/2409.05283","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:0906a19fffae5480f0a8ee5c862a83a3cfba56b76e2719e3deba9bcf8eb0849b","observation_id":"f8ad62ca-1ba5-4727-9cb2-3e777369595e","resolution":{"observed_at":"2026-08-15T20:32:05.976913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20094","last_updated":"2025-05-08T00:24:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-28T17:59:01Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20094","snapshot_observed_at":"2026-08-15T20:32:05.980080Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.980080Z"},"links":{"cited_paper":"/paper/2406.20094","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:906e4e62b42f104a96b009896c1ad0ea546b04694493df9cdd67451d4d72719a","observation_id":"b9876cf0-f62f-4778-b386-d9cab591fcd6","resolution":{"observed_at":"2026-08-15T20:32:05.980080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08433","last_updated":"2023-10-12T15:56:24Z","snapshot_observed_at":"2026-08-13T05:50:32.484898Z","submitted_at":"2023-10-12T15:56:24Z","title":"A Confederacy of Models: a Comprehensive Evaluation of LLMs on Creative Writing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08433","snapshot_observed_at":"2026-08-15T20:32:05.983486Z","title":"Gómez-Rodríguez and P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.983486Z"},"links":{"cited_paper":"/paper/2310.08433","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:85c64b6aa21a742f42b436fd477bf374cd5e5e0211d8a2b43a9916535baa41e1","observation_id":"ba22273b-4637-47a3-b993-ae7d96a24331","resolution":{"observed_at":"2026-08-15T20:32:05.983486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T20:32:05.986356Z","title":"Grattafiori, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.986356Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:8819f68320699f9109ae0ca8cdc0cbe409073ef5978a9685ff1e2cd65e2dbe37","observation_id":"e414a9ae-5d4d-4fb0-8eeb-3b8e87d5493e","resolution":{"observed_at":"2026-08-15T20:32:05.986356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03296","last_updated":"2023-08-07T04:47:42Z","snapshot_observed_at":"2026-08-13T10:39:42.466802Z","submitted_at":"2023-08-07T04:47:42Z","title":"Studying Large Language Model Generalization with Influence Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03296","snapshot_observed_at":"2026-08-15T20:32:05.988896Z","title":"Grosse, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.988896Z"},"links":{"cited_paper":"/paper/2308.03296","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:e850b5b867af30928651eae9b37624c3d5194f8758eb21341348553adb9c3e35","observation_id":"e7f4457d-5d34-4358-be99-b16a4ffd2071","resolution":{"observed_at":"2026-08-15T20:32:05.988896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.735142Z","title":null,"venue":null,"work_id":"1e593355-fc10-4a40-8297-9f146171314f","year":2022},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.991790Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:1c079b62785816680944ca96f7b9999b9bad51874ff83b20c93cde685a7671b6","observation_id":"9d53860c-5a50-4f99-8268-39e4abe955f2","resolution":{"observed_at":"2026-08-15T20:32:06.738419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07064","last_updated":"2025-03-18T23:52:27Z","snapshot_observed_at":"2026-08-12T22:27:02.729999Z","submitted_at":"2024-10-09T17:06:57Z","title":"Data Selection via Optimal Control for Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07064","snapshot_observed_at":"2026-08-15T20:32:05.994275Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.994275Z"},"links":{"cited_paper":"/paper/2410.07064","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:d5ae26e8240f3900320a01efb5a7b2c4e8d8226a1eb716d5e851453c26f378fc","observation_id":"73f17fe6-595f-416c-b5d8-c06cfa7c66f2","resolution":{"observed_at":"2026-08-15T20:32:05.994275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T20:32:05.997054Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:05.997054Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:b4370b0d2ed44bb733f13cf9eeca53bcdfa6911010df1183f69a5db68b8d7138","observation_id":"1c727a66-9413-48c8-8c5b-3a6008d5bd35","resolution":{"observed_at":"2026-08-15T20:32:05.997054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.725045Z","title":null,"venue":null,"work_id":"6a210abf-6841-4df3-971a-238d21ebd232","year":1974},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.000743Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:fc35bbfa64970ec1614c9181c176eab95aa9510b4ec54dae67220d8b1342acec","observation_id":"842fc8e7-a233-4027-a868-8fccd8fdac4f","resolution":{"observed_at":"2026-08-15T20:32:06.728548Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-15T20:32:06.003978Z","title":"Hendrycks, C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.003978Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:73b63fb1716f43f0256ce719c3a6e4c404a116d5edde44ba63cd46e1b16a6414","observation_id":"49d92fe5-96f1-4a78-92d5-ba3f4a418956","resolution":{"observed_at":"2026-08-15T20:32:06.003978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.715092Z","title":null,"venue":null,"work_id":"563ba7dd-20aa-439d-8a61-c781d4d2f19e","year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.007125Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:000b61340c02b932baf462838773a992ae0aac0c0667d249ae628cbe29c9c09b","observation_id":"a56a8777-4bed-47ad-b00a-3d8c2cc9eef1","resolution":{"observed_at":"2026-08-15T20:32:06.718418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.00622","last_updated":"2022-02-01T18:15:24Z","snapshot_observed_at":"2026-08-13T16:48:58.882699Z","submitted_at":"2022-02-01T18:15:24Z","title":"Datamodels: Predicting Predictions from Training Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.00622","snapshot_observed_at":"2026-08-15T20:32:06.010090Z","title":"Ilyas, S","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.010090Z"},"links":{"cited_paper":"/paper/2202.00622","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:17afec62c9d90a73f77650b21c15767ec7b22ff2a295f11538d8d7890d6dd5c0","observation_id":"eefd2788-1c8e-4103-bbf6-9befca788278","resolution":{"observed_at":"2026-08-15T20:32:06.010090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02774","last_updated":"2024-05-05T00:08:00Z","snapshot_observed_at":"2026-08-13T00:14:45.625191Z","submitted_at":"2024-05-05T00:08:00Z","title":"Get more for less: Principled Data Selection for Warming Up Fine-Tuning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02774","snapshot_observed_at":"2026-08-15T20:32:06.013449Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.013449Z"},"links":{"cited_paper":"/paper/2405.02774","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:4b77c533702e6ac3675dbc7eeee5f2d7e85b0b32ea5002ac932195d4ae9bd4cc","observation_id":"21799020-8b87-4227-987d-57f0a9c73362","resolution":{"observed_at":"2026-08-15T20:32:06.013449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.016907Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.016907Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:d40a5a96ca7c35712a49d22f4d1dd35f3344c2671a18229bb1d509442598c968","observation_id":"0eea2300-246d-43c2-b8ea-3f5f60166270","resolution":{"observed_at":"2026-08-15T20:32:06.016907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19093","last_updated":"2025-04-27T03:41:17Z","snapshot_observed_at":"2026-08-16T05:59:22.377813Z","submitted_at":"2025-04-27T03:41:17Z","title":"CipherBank: Exploring the Boundary of LLM Reasoning Capabilities through Cryptography Challenges","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19093","snapshot_observed_at":"2026-08-15T20:32:06.020213Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.020213Z"},"links":{"cited_paper":"/paper/2504.19093","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:1444d4795a7887ad5c65002125323ab357c06d60cb4a4e39141db85b3cd25fff","observation_id":"1d54c371-39de-4993-9cfe-8e8b42a95a0b","resolution":{"observed_at":"2026-08-15T20:32:06.020213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07958","last_updated":"2022-05-08T02:43:02Z","snapshot_observed_at":"2026-08-03T16:26:48.747700Z","submitted_at":"2021-09-08T17:15:27Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.07958","snapshot_observed_at":"2026-08-15T20:32:06.023634Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.023634Z"},"links":{"cited_paper":"/paper/2109.07958","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:c3bb92b75f0f4c4d0240ab423fe119f923dfe3e42c5ba954aab7adcc05f987a5","observation_id":"2857952d-086c-4840-9b47-35daad2df631","resolution":{"observed_at":"2026-08-15T20:32:06.023634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.700012Z","title":null,"venue":null,"work_id":"adb4aafb-e74c-4e70-8d35-b0302fc9eabe","year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.027154Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:657595d83c3d595ed2be2fc6435fc8afe17b85c16634c4c1e79e3cd66ec1466a","observation_id":"98f770aa-d898-4bf0-97a0-4e07cebe3da0","resolution":{"observed_at":"2026-08-15T20:32:06.703267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01492","last_updated":"2025-01-23T17:35:43Z","snapshot_observed_at":"2026-08-12T23:31:04.473877Z","submitted_at":"2024-07-01T17:31:03Z","title":"RegMix: Data Mixture as Regression for Language Model Pre-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01492","snapshot_observed_at":"2026-08-15T20:32:06.030455Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.030455Z"},"links":{"cited_paper":"/paper/2407.01492","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:dfac2b452f8d3277110af5ce19748e5253e6e49002982388a868e941721a9429","observation_id":"997aa51a-c8a5-4453-9aa6-19e2f7b97e0b","resolution":{"observed_at":"2026-08-15T20:32:06.030455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15685","last_updated":"2024-04-16T02:46:58Z","snapshot_observed_at":"2026-08-13T04:54:16.874411Z","submitted_at":"2023-12-25T10:29:28Z","title":"What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15685","snapshot_observed_at":"2026-08-15T20:32:06.033922Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.033922Z"},"links":{"cited_paper":"/paper/2312.15685","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:5bf553651d7b395e4f986a6bc1c6dc0eb170e95aaf3f23a155da52829c2e22ab","observation_id":"0571aa7a-9c6b-4218-9a4c-0552ce0d1809","resolution":{"observed_at":"2026-08-15T20:32:06.033922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.690366Z","title":null,"venue":null,"work_id":"48f8fa61-2aa6-4a81-9e42-132086c57f14","year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.037585Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:962d963678bdda99149d7428bb470c1ff764019c604823cda1b5f23410137532","observation_id":"06ed8a7f-db35-4c6e-a70d-fda8c35b0cd9","resolution":{"observed_at":"2026-08-15T20:32:06.693799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08967","last_updated":"2024-12-13T04:44:11Z","snapshot_observed_at":"2026-08-13T04:40:53.870336Z","submitted_at":"2024-01-17T04:43:21Z","title":"ReFT: Reasoning with Reinforced Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08967","snapshot_observed_at":"2026-08-15T20:32:06.040832Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.040832Z"},"links":{"cited_paper":"/paper/2401.08967","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:e9fe6d6e28a4db7da04460769d60c4e7f711e7eede0e5d9cc52534b8ad2a09e1","observation_id":"ad3716d9-eede-40f5-97f2-8feedcb0a7ef","resolution":{"observed_at":"2026-08-15T20:32:06.040832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.680319Z","title":"Martens and R","venue":null,"work_id":"0b410fb5-6e36-40ee-bed5-c2cb2624c37e","year":2015},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.044362Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:23a730c2b8c3131434c1e442c9f726b1f0bbc1de3aa9ea391073db36de32e988","observation_id":"4c44f3b9-af74-45d2-bfb3-2e9b23d38a08","resolution":{"observed_at":"2026-08-15T20:32:06.683850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00213","last_updated":"2024-04-02T20:09:45Z","snapshot_observed_at":"2026-08-14T09:59:52.654720Z","submitted_at":"2024-03-30T01:56:07Z","title":"Injecting New Knowledge into Large Language Models via Supervised Fine-Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.00213","snapshot_observed_at":"2026-08-15T20:32:06.047770Z","title":"Mecklenburg, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.047770Z"},"links":{"cited_paper":"/paper/2404.00213","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:96ba1f85d0fa4edd7de0da366c46308efd67b42c7260404b9bf6f8983ef37da7","observation_id":"75989471-8ffb-4b03-b1d4-796ab18c9a60","resolution":{"observed_at":"2026-08-15T20:32:06.047770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10430","last_updated":"2024-02-16T03:39:37Z","snapshot_observed_at":"2026-08-14T09:26:03.634955Z","submitted_at":"2024-02-16T03:39:37Z","title":"Smaller Language Models are capable of selecting Instruction-Tuning Training Data for Larger Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10430","snapshot_observed_at":"2026-08-15T20:32:06.051092Z","title":"Mekala, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.051092Z"},"links":{"cited_paper":"/paper/2402.10430","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:6efe99ca39abb9cd48d95525a70a1e9e315969e1167a3527e05913212cf9a979","observation_id":"7a2de7e0-ceb6-4543-bc25-cdd76d2a855f","resolution":{"observed_at":"2026-08-15T20:32:06.051092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.669930Z","title":"Muennighoff, A","venue":null,"work_id":"369e6c8e-f724-4f7a-9998-bbdc6645641c","year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.054431Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:86b09a6c30c1c7b5de2068652cc4c1af7e235c1c460b7fd3f2a8ee87dddecf73","observation_id":"7d1ba1ac-a3ff-44c8-b0b0-3ccd06495c52","resolution":{"observed_at":"2026-08-15T20:32:06.673704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T20:32:06.057507Z","title":"Achiam, and S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.057507Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:4bd0ed6e150b3ff16b160e9fe5aea623cfa4007042b53ee6ebc8e5a8692568a6","observation_id":"77b41c54-840f-46c8-b393-538e6411f163","resolution":{"observed_at":"2026-08-15T20:32:06.057507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17439","last_updated":"2025-05-30T15:19:51Z","snapshot_observed_at":"2026-08-07T16:45:50.800051Z","submitted_at":"2025-03-21T17:59:10Z","title":"LEMMA: Learning from Errors for MatheMatical Advancement in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17439","snapshot_observed_at":"2026-08-15T20:32:06.060570Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.060570Z"},"links":{"cited_paper":"/paper/2503.17439","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:158ec422e9169d2c7857ada8fd9d8aeb82fe90896e584996a4c46d49b7c3d3c5","observation_id":"c9c5daea-9271-411f-8d6d-526829ba7c3a","resolution":{"observed_at":"2026-08-15T20:32:06.060570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.14186","last_updated":"2023-04-03T17:37:50Z","snapshot_observed_at":"2026-08-13T12:17:31.022164Z","submitted_at":"2023-03-24T17:56:22Z","title":"TRAK: Attributing Model Behavior at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.14186","snapshot_observed_at":"2026-08-15T20:32:06.063773Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.063773Z"},"links":{"cited_paper":"/paper/2303.14186","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:12d3ad6be537bc6003981cc2a031f993e0e326f245d4c99dd7d197ca0e197fbf","observation_id":"e6de06b6-6273-4797-b078-3cf254aa804e","resolution":{"observed_at":"2026-08-15T20:32:06.063773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06380","last_updated":"2024-10-19T16:51:38Z","snapshot_observed_at":"2026-08-12T23:26:21.266194Z","submitted_at":"2024-07-08T20:47:58Z","title":"Data, Data Everywhere: A Guide for Pretraining Dataset Construction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06380","snapshot_observed_at":"2026-08-15T20:32:06.066902Z","title":"Parmar, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.066902Z"},"links":{"cited_paper":"/paper/2407.06380","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:0d26e2f671d7ae25bf1520018443570d50ebf7d92082d8c67a074f98f0ea145c","observation_id":"f2d3ec5c-7a07-473b-b798-328e0aa23932","resolution":{"observed_at":"2026-08-15T20:32:06.066902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16212","last_updated":"2025-06-16T05:58:00Z","snapshot_observed_at":"2026-08-12T13:19:10.332127Z","submitted_at":"2025-03-20T15:00:41Z","title":"MathFusion: Enhancing Mathematical Problem-solving of LLM through Instruction Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16212","snapshot_observed_at":"2026-08-15T20:32:06.069675Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.069675Z"},"links":{"cited_paper":"/paper/2503.16212","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:d7af742c059182697f84337c94e744666bf6de1eedea3c513c3c3e489dc2aa5c","observation_id":"1e37ae55-b68e-463e-9f41-4676aaf3bc6b","resolution":{"observed_at":"2026-08-15T20:32:06.069675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.661144Z","title":null,"venue":null,"work_id":"b544628e-f2a7-4a3d-8c21-7428e82a02df","year":2018},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.072464Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:4be2a92b343c6766da04197e4527b5a7cb99bb6245363917f447ff56a5ca7240","observation_id":"678afc28-725d-4084-a181-dc0729d2407f","resolution":{"observed_at":"2026-08-15T20:32:06.664040Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.651284Z","title":"Pruthi, F","venue":null,"work_id":"2219f534-5f70-41e3-9688-2b34df97f848","year":2020},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.074811Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:693a40c670d7cdb9130bb2b25396dc23212dc96fdf311e09f6778f875a5be94a","observation_id":"cbc7dd52-701d-4c08-bb8c-243cd65eb4d4","resolution":{"observed_at":"2026-08-15T20:32:06.654942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14526","last_updated":"2024-06-03T06:48:34Z","snapshot_observed_at":"2026-08-13T16:44:54.218846Z","submitted_at":"2024-02-22T13:20:53Z","title":"Balanced Data Sampling for Language Model Training with Clustering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14526","snapshot_observed_at":"2026-08-15T20:32:06.077830Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.077830Z"},"links":{"cited_paper":"/paper/2402.14526","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:bdf56eee3069ceb244c6e016382d76a2f1bc2a47670606e9bd5fd1e7e7cb14c1","observation_id":"47ae2de8-57cf-4c1a-9f6a-5cdc1b8200e8","resolution":{"observed_at":"2026-08-15T20:32:06.077830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06094","last_updated":"2024-02-08T23:02:04Z","snapshot_observed_at":"2026-08-15T18:51:51.302605Z","submitted_at":"2024-02-08T23:02:04Z","title":"Rethinking Data Selection for Supervised Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06094","snapshot_observed_at":"2026-08-15T20:32:06.080828Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.080828Z"},"links":{"cited_paper":"/paper/2402.06094","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:e608d9f07e6a1490e2f278179af464c9e23daac34a5d8bb8ccbcf879be121ca4","observation_id":"ad82887a-a0d0-4be7-8957-fe8ca087b3d2","resolution":{"observed_at":"2026-08-15T20:32:06.080828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10818","last_updated":"2024-05-09T13:56:06Z","snapshot_observed_at":"2026-08-13T10:09:46.005593Z","submitted_at":"2023-09-19T17:59:54Z","title":"SlimPajama-DC: Understanding Data Combinations for LLM Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10818","snapshot_observed_at":"2026-08-15T20:32:06.084337Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.084337Z"},"links":{"cited_paper":"/paper/2309.10818","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:4cf8f19a5eaa9a2dc89dd1c18af134642c559f0850fc124702e8b6a4def862b2","observation_id":"b1be91f0-d13b-4893-899d-6a4aea02c107","resolution":{"observed_at":"2026-08-15T20:32:06.084337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.641076Z","title":null,"venue":null,"work_id":"54ab5483-d66d-40c8-8845-c30f757c6229","year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.088451Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:34ec0f90f8f16a615f6b0e4f1e75d49d456c1599c769e52a7435611dad710be1","observation_id":"1dfcad7f-426f-4d45-abfc-db99569f37b3","resolution":{"observed_at":"2026-08-15T20:32:06.644257Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-15T20:32:06.091850Z","title":"Suzgun, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.091850Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:0dc3157ce017ecbdb1f3e28935a693dec58847cb2a33671511d8e258514e4e34","observation_id":"8bd1ec75-c045-4136-a94f-ec7307554676","resolution":{"observed_at":"2026-08-15T20:32:06.091850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T20:32:06.095162Z","title":"Touvron, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.095162Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:dbf9712e78d7941a02ed99920ff35bfd98db476aa18077014141e6420f188aca","observation_id":"d44ac2e9-ea97-42bb-a1cd-6a3f759e7ef6","resolution":{"observed_at":"2026-08-15T20:32:06.095162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.631889Z","title":"Tunstall, E","venue":null,"work_id":"3ce40f76-46ab-4e6e-a491-2d1ce13d01d7","year":null},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.098475Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:b7ac0bfcdf5f99ab565d89bf0837e9ff0ad03a46e782745c3ee4f9ba7830ed23","observation_id":"6632bf36-1b61-421b-bf5c-a0df4c4575fb","resolution":{"observed_at":"2026-08-15T20:32:06.634869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.621720Z","title":null,"venue":null,"work_id":"4b3af389-52b9-48fe-873b-1e0c667ea87a","year":2020},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.101847Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:442ec22c6c3cf830d26a4db455506aff1a21e1b9a0626fdce159621adaf84186","observation_id":"f162ce24-68c8-483c-bdb6-880643b52cae","resolution":{"observed_at":"2026-08-15T20:32:06.625120Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17268","last_updated":"2024-01-30T18:58:43Z","snapshot_observed_at":"2026-08-14T19:47:15.144770Z","submitted_at":"2024-01-30T18:58:43Z","title":"Weaver: Foundation Models for Creative Writing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.17268","snapshot_observed_at":"2026-08-15T20:32:06.105533Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.105533Z"},"links":{"cited_paper":"/paper/2401.17268","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:820657eb2cfee3741f367502fddc10806528b07f03cf04dc5ece2b988dbcf832","observation_id":"cc19f26a-1d82-4aeb-aa97-6cdadeaf3efc","resolution":{"observed_at":"2026-08-15T20:32:06.105533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12966","last_updated":"2023-07-24T17:44:58Z","snapshot_observed_at":"2026-08-14T14:27:25.466650Z","submitted_at":"2023-07-24T17:44:58Z","title":"Aligning Large Language Models with Human: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12966","snapshot_observed_at":"2026-08-15T20:32:06.108893Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.108893Z"},"links":{"cited_paper":"/paper/2307.12966","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:ee0d6955453fef9fc3ddd35d529bf18da255003ede5aea5abef1d8b70d59c02f","observation_id":"1558201b-26df-488b-9c14-85b487cd1831","resolution":{"observed_at":"2026-08-15T20:32:06.108893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04333","last_updated":"2024-06-13T03:42:02Z","snapshot_observed_at":"2026-08-13T04:24:51.821062Z","submitted_at":"2024-02-06T19:18:04Z","title":"LESS: Selecting Influential Data for Targeted Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04333","snapshot_observed_at":"2026-08-15T20:32:06.112224Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.112224Z"},"links":{"cited_paper":"/paper/2402.04333","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:b091c26338eab9eaf3f427b8c2851ce9b200585d34b354c903706f722307a412","observation_id":"58a20d5e-0717-4bd0-adc8-4543c0628660","resolution":{"observed_at":"2026-08-15T20:32:06.112224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.611521Z","title":null,"venue":null,"work_id":"17cd7cba-af3f-40db-bb4d-57676e846439","year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.115313Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:119a6440776e751e06e037bb9437b8692af4c631bc697a74ddd0de2afe25dc8b","observation_id":"6b9b2006-ef64-40f6-8335-f2be4f3e4f77","resolution":{"observed_at":"2026-08-15T20:32:06.614918Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-08-13T02:06:18.586697Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-15T20:32:06.118657Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.118657Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:a8fffa4489ec8ef5b9502ebcc85ba4b17a3a37ab86962e878780c33fb1f5c3a8","observation_id":"078d9d11-6672-483b-906f-1ac9d9958391","resolution":{"observed_at":"2026-08-15T20:32:06.118657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16952","last_updated":"2025-03-20T03:31:27Z","snapshot_observed_at":"2026-08-13T15:22:13.497826Z","submitted_at":"2024-03-25T17:14:00Z","title":"Data Mixing Laws: Optimizing Data Mixtures by Predicting Language Modeling Performance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16952","snapshot_observed_at":"2026-08-15T20:32:06.122055Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.122055Z"},"links":{"cited_paper":"/paper/2403.16952","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:2caaba23d08e0b1adb392c594ad14c3a13fcdc8d90cd43f743d25789243b695b","observation_id":"494e964e-73f7-46b2-957e-9554948dab5c","resolution":{"observed_at":"2026-08-15T20:32:06.122055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06046","last_updated":"2024-11-16T02:59:22Z","snapshot_observed_at":"2026-08-14T20:41:26.950056Z","submitted_at":"2024-06-10T06:27:42Z","title":"MATES: Model-Aware Data Selection for Efficient Pretraining with Data Influence Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06046","snapshot_observed_at":"2026-08-15T20:32:06.125097Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.125097Z"},"links":{"cited_paper":"/paper/2406.06046","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:e024ed187f00af88e929368ab7d516e35f481eede73276a33ae396bb93d6528d","observation_id":"b747885b-54fb-4515-b014-9f40ca1aff07","resolution":{"observed_at":"2026-08-15T20:32:06.125097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16986","last_updated":"2024-10-05T06:11:12Z","snapshot_observed_at":"2026-08-14T17:02:37.213362Z","submitted_at":"2024-09-25T14:49:29Z","title":"Harnessing Diversity for Important Data Selection in Pretraining Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16986","snapshot_observed_at":"2026-08-15T20:32:06.128370Z","title":"Zhang, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.128370Z"},"links":{"cited_paper":"/paper/2409.16986","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:0b06e0cdfefa501abcececf0df1c32caa97a4454d77cd78bec028852e8f5a355","observation_id":"90477259-6ad3-4842-9336-ef5caf3d43a3","resolution":{"observed_at":"2026-08-15T20:32:06.128370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10306","last_updated":"2025-02-24T07:59:10Z","snapshot_observed_at":"2026-08-13T19:39:41.487267Z","submitted_at":"2024-04-16T06:27:39Z","title":"Balancing Speciality and Versatility: A Coarse to Fine Framework for Mitigating Catastrophic Forgetting in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10306","snapshot_observed_at":"2026-08-15T20:32:06.131827Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.131827Z"},"links":{"cited_paper":"/paper/2404.10306","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:69ec6dd1da034f5cf77d5c2efa8dea4d3f2572b516a3183571749588fbd4b113","observation_id":"d8597c42-56d9-4d69-873c-4963df8469c4","resolution":{"observed_at":"2026-08-15T20:32:06.131827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:32:06.600810Z","title":null,"venue":null,"work_id":"948ca847-6530-41f4-9fbf-6f24bd27f7dd","year":null},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.135397Z"},"links":{"citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:dbc16f9f731b965c27e8ba37458664a054cde2e11ffc9d4542231766eece1467","observation_id":"2622082b-d9dd-45ca-929d-7bc1e2e430a1","resolution":{"observed_at":"2026-08-15T20:32:06.604597Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07911","last_updated":"2023-11-14T05:13:55Z","snapshot_observed_at":"2026-07-06T16:47:08.877195Z","submitted_at":"2023-11-14T05:13:55Z","title":"Instruction-Following Evaluation for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07911","snapshot_observed_at":"2026-08-15T20:32:06.138481Z","title":"14 A Dataset and Training Information Reasoning:We initially select BigBench Hard (BBH) [55] as the benchmark to evaluate the reasoning capabilities of our model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T20:32:06.138481Z"},"links":{"cited_paper":"/paper/2311.07911","citing_paper":"/paper/2505.12762"},"observation_digest":"sha256:e54e93ab3014c9b198507f1691b90a950999c4334692aecb59a1d33179b50c32","observation_id":"282c8e4c-37da-44a6-8666-ca8fe5c95b41","resolution":{"observed_at":"2026-08-15T20:32:06.138481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.12762","last_updated":"2025-05-19T06:42:44Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-15T20:24:43.950241Z","submitted_at":"2025-05-19T06:42:44Z","title":"IDEAL: Data Equilibrium Adaptation for Multi-Capability Language Model Alignment"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":59,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 1 inbound Pith citation observation for arXiv:2505.12762."}