{"as_of":"2026-08-02T02:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6470eb7bb975f3f9c6a2181184b16cfc78a08bb6ee565c11cd0626fec265019b","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-23T20:42:38.782232Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-01T06:32:01.292127+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:42:37.269767Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06624","snapshot_observed_at":"2026-08-01T10:42:37.269767Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20145","last_updated":"2026-07-30T09:30:44Z","snapshot_observed_at":"2026-08-02T02:17:25.325808Z","submitted_at":"2026-07-22T13:49:17Z","title":"SLAI T-Rex: Full-Parameter Post-training of the DeepSeek-V4 Family on Ascend SuperPOD","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T10:42:37.269767Z"},"links":{"cited_paper":"/paper/2409.06624","citing_paper":"/paper/2607.20145"},"observation_digest":"sha256:057098313e4dab396bd2a6ab755014200d34fe60d90a96021f415d39870f50c5","observation_id":"416b8a08-a33f-4710-a2db-18ba5e2dd20b","resolution":{"observed_at":"2026-08-01T10:42:37.269767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2409.06624/citation-record","integrity":"/paper/2409.06624/integrity","json":"/paper/2409.06624/citation-record.json","paper":"/paper/2409.06624"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Findings of ACL 2023 (2023)","venue":null,"work_id":"b6b9308b-6053-4362-9579-84eca198784f","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:b9d65dc0f5ee56ba2cb4753b49dedaac85c5a0cffa06937b4ad53208be14b642","observation_id":"e3f584ea-f017-4056-a7a9-b86cfba4ed6d","resolution":{"observed_at":"2026-05-23T20:43:25.978197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"48b34612-c4cc-43fa-98a3-5c1ef7451627","year":2024},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:4f73a3c836c94df889ecca15599443af83113420d15295990cacbe0c684f4af5","observation_id":"9a506b35-d676-410b-87f2-431e8aaf913c","resolution":{"observed_at":"2026-05-23T20:43:26.009022Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.00920","last_updated":"2019-05-29T02:55:39Z","snapshot_observed_at":"2026-07-06T06:42:45.078166Z","submitted_at":"2018-06-04T01:50:21Z","title":"DRCD: a Chinese Machine Reading Comprehension Dataset","version":3},"cited_work":{"arxiv_id":"1806.00920","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.00920","snapshot_observed_at":"2026-07-04T10:19:47.664878Z","title":"DRCD: a Chinese Machine Reading Comprehension Dataset","venue":"cs.CL","work_id":"be7ebdb1-2493-4a5e-a996-1478d1141941","year":2018},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/1806.00920","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:f9dbc576b5cc95ef22f027816aac591e7030a4989e4d83a2fa89dcc3faa38326","observation_id":"a15b4b2d-d573-4145-8b85-7a1200cedf2d","resolution":{"observed_at":"2026-05-23T20:43:25.225541Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:251d959019d462583cc59230852d047f45a15d9da22b1d4fb4addcfb3b4a0c0d","observation_id":"a4a907e2-d065-447b-97a7-15f181d41651","resolution":{"observed_at":"2026-05-23T20:43:25.304939Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: EMNLP-IJCNLP (2019)","venue":null,"work_id":"23aed32d-df1d-4b5e-bbc4-67b2a31157f7","year":2019},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:7ac0361c01819073237e306e75afcb807ca9b270c6ec41b7bc31cabba2e4da16","observation_id":"fed40c13-73cd-471f-bbb7-97cc55794876","resolution":{"observed_at":"2026-05-23T20:43:26.020010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":"2009.03300","doi":"10.48550/arxiv.2009.03300","metadata_source":"pith","pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-07-11T01:37:42.666395Z","title":"Measuring Massive Multitask Language Understanding","venue":"cs.CY","work_id":"e87ec49a-544b-4ec8-8991-75298c64ff5e","year":2020},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:2d928b1564aa2d88addfd49327e16f464ba14e2c62a801c5a400b9162fa3bef0","observation_id":"82e89080-04d0-4030-be8e-d3148897230b","resolution":{"observed_at":"2026-05-23T20:43:25.295173Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-07-11T02:19:14.061878+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T02:19:14.061878+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13650","last_updated":"2023-10-20T16:53:51Z","snapshot_observed_at":"2026-07-06T16:36:15.820331Z","submitted_at":"2023-10-20T16:53:51Z","title":"BotChat: Evaluating LLMs' Capabilities of Having Multi-Turn Dialogues","version":1},"cited_work":{"arxiv_id":"2310.13650","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.13650","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3506a3d1-42b6-4f22-9320-c9e59b67dd25","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2310.13650","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:cdac46ed17b773b9d4c82793f8fb86a1e0671cb870f3bdb6613fe2e2ceaee976","observation_id":"0d0dfd13-317d-4d9b-8e12-ec7664703b43","resolution":{"observed_at":"2026-05-23T20:43:25.208096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"27935b1d-8383-416b-afea-7d7f40232bca","year":2024},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:feaf5fc106378e4e18580d6c25c04a62653daa899da321604e56b32895a25fb2","observation_id":"08a556dd-ab82-469e-83b3-5b9c0153145b","resolution":{"observed_at":"2026-05-23T20:43:26.016625Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17467","last_updated":"2024-10-07T05:16:25Z","snapshot_observed_at":"2026-07-06T18:51:28.182977Z","submitted_at":"2024-07-24T17:59:02Z","title":"CMR Scaling Law: Predicting Critical Mixture Ratios for Continual Pre-training of Language Models","version":2},"cited_work":{"arxiv_id":"2407.17467","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.17467","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2407.17467 , year=","venue":null,"work_id":"91459743-1528-4aeb-9707-a54edcac5f6f","year":2024},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2407.17467","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:a4421c351eb0fdac187b52c53e011f75c670209f3c4b2dd2856dddf5f5aa4d16","observation_id":"029bf7e3-5c76-49ed-ac41-7a79dcb4cb26","resolution":{"observed_at":"2026-05-23T20:43:25.265199Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10964","last_updated":"2020-05-05T22:00:44Z","snapshot_observed_at":"2026-07-06T09:14:32.318388Z","submitted_at":"2020-04-23T04:21:19Z","title":"Don't Stop Pretraining: Adapt Language Models to Domains and Tasks","version":3},"cited_work":{"arxiv_id":"2004.10964","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.10964","snapshot_observed_at":"2026-07-05T17:21:18.056837Z","title":"Don’t stop pretraining: Adapt language models to domains and tasks","venue":"cs.CL","work_id":"7474b2b4-b1ac-4816-aa36-5e59e1cde1e5","year":2020},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2004.10964","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:535fa6a664fd89663b4e88aac285029e10ff75365e582eb786b650b1af23167c","observation_id":"b63c750e-d98a-4f7f-8826-103fa153db43","resolution":{"observed_at":"2026-05-23T20:43:25.275088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":"2203.15556","doi":"10.1098/rsta.2024.0522","metadata_source":"pith","pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Compute-Optimal Large Language Models","venue":"cs.CL","work_id":"b2faf28d-86b7-429c-bc42-469458efc246","year":2022},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:4b13625a8f9b0d99c7f5c72b97ae1c9fd5d1b09df01fdca20cf05dc70ebf961f","observation_id":"8b1f3197-1f63-4abf-9e52-873a5ab2f18f","resolution":{"observed_at":"2026-05-23T20:43:25.300044Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Màrquez, L., Callison-Burch, C., Su, J","venue":null,"work_id":"e4c3314d-05b0-4e7d-a994-0f75b0f14173","year":2015},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:ed1217ceb96246fc4f1587436dc88bb6cdd1fec78442e0a520e6c4ed6353ce32","observation_id":"13afc7aa-e79a-4cfe-866a-e69fb069731d","resolution":{"observed_at":"2026-05-23T20:43:26.012253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":"2001.08361","doi":"10.1145/3616855.3635845","metadata_source":"pith","pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Scaling Laws for Neural Language Models","venue":"cs.LG","work_id":"b7dd8749-9c45-4977-ab9b-64478dce1ae8","year":2020},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:8fe0ac78aed0bf048ec461b196f8f4567768d031a1122910210db2e0fa6cc8a6","observation_id":"996e7b15-57bb-402c-8210-b54c8e2e71e7","resolution":{"observed_at":"2026-05-23T20:43:25.202537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16694","last_updated":"2024-06-24T14:58:11Z","snapshot_observed_at":"2026-07-06T18:36:07.983955Z","submitted_at":"2024-06-24T14:58:11Z","title":"Task Oriented In-Domain Data Augmentation","version":1},"cited_work":{"arxiv_id":"2406.16694","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.16694","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"46ff3a13-8c98-4d79-bd61-ff9e554898c8","year":2024},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2406.16694","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:7f985e9cc6b3bc404d74ec228772bf6f4eaed3703bf4704496db7f58d1005150","observation_id":"0c1854a7-3621-47b6-8c91-9527f8f13e01","resolution":{"observed_at":"2026-05-23T20:43:25.279872Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.07498","last_updated":"2021-09-29T17:09:40Z","snapshot_observed_at":"2026-08-01T14:47:10.324996Z","submitted_at":"2021-07-15T17:51:25Z","title":"FewCLUE: A Chinese Few-shot Learning Evaluation Benchmark","version":2},"cited_work":{"arxiv_id":"2107.07498","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.07498","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"67c82337-7025-485a-972f-2c8e7b438f9c","year":2021},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2107.07498","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:4c41c0eb37d45ba816a86ddfa7a8c356d13591cdecd3de59087a9b6bf5146105","observation_id":"9e28e0d6-15e6-49eb-ab9d-7befe2ef5baa","resolution":{"observed_at":"2026-05-23T20:43:25.269973Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15696","last_updated":"2023-12-25T11:31:47Z","snapshot_observed_at":"2026-07-06T17:07:52.197869Z","submitted_at":"2023-12-25T11:31:47Z","title":"EcomGPT-CT: Continual Pre-training of E-commerce Large Language Models with Semi-structured Data","version":1},"cited_work":{"arxiv_id":"2312.15696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.15696","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"269df10d-b47b-4e8f-9f6b-946e130a42cc","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2312.15696","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:29b1c466cde7e20b74758015f7cc9529e76422d851dba4db2d0f75e618bd35d4","observation_id":"6bff9a88-bb43-4259-ac02-662a654e7abf","resolution":{"observed_at":"2026-05-23T20:43:25.231006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.03551","last_updated":"2017-05-13T21:12:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-05-09T21:35:07Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","version":2},"cited_work":{"arxiv_id":"1705.03551","doi":"10.48550/arxiv.1705.03551","metadata_source":"pith","pith_arxiv_id":"1705.03551","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"TriviaQA: A Large Scale Distantly Supervised Challenge Dataset for Reading Comprehension","venue":"cs.CL","work_id":"f20e62ba-6265-4b97-aa8c-ddefaf2f5762","year":2017},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/1705.03551","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:2baa84a5c179dc457e31b3335177ad02b2d6fdf869c64e239a17d2f349c6e13b","observation_id":"2004c911-b647-4e56-926c-956c92f8a199","resolution":{"observed_at":"2026-05-23T20:43:25.219775Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":"2107.03374","doi":"10.48550/arxiv.2107.03374","metadata_source":"pith","pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-07-11T03:27:46.202228Z","title":"Evaluating Large Language Models Trained on Code","venue":"cs.LG","work_id":"042493e9-b26f-4b4e-bbde-382072ca9b08","year":2021},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:90541e4a2b842e7d0c3e076af4fcf330a047ac0205af800f4b14c4bda3d6a372","observation_id":"48a95306-ecad-4994-8913-f7d7bc66aa41","resolution":{"observed_at":"2026-05-23T20:43:25.289897Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T08:08:23.404839+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T08:08:23.404839+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":"2203.02155","doi":"10.1007/s00354-022-00198-8","metadata_source":"pith","pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training language models to follow instructions with human feedback","venue":"cs.CL","work_id":"52aff42f-4fa9-4fcf-bdb3-1459b9bebf65","year":2022},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:dba0dc992376bf67cde3fae8f8fd4efb2fb6718e088137993294b1ad10ac87f1","observation_id":"677879ec-cdce-4db7-a6a4-55226f716090","resolution":{"observed_at":"2026-05-23T20:43:25.213933Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01375","last_updated":"2024-06-03T14:40:31Z","snapshot_observed_at":"2026-07-06T18:24:26.225262Z","submitted_at":"2024-06-03T14:40:31Z","title":"D-CPT Law: Domain-specific Continual Pre-Training Scaling Law for Large Language Models","version":1},"cited_work":{"arxiv_id":"2406.01375","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01375","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"18b129b5-c460-4d37-986b-4420f91ca2ee","year":2024},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2406.01375","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:0c540ccd899b6fc7083670f92321b65b0d20e3da372f47caebf9f7027120e6f9","observation_id":"3e28a103-38f6-4bb9-8364-33140453541d","resolution":{"observed_at":"2026-05-23T20:43:25.284698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: Oh, A., Naumann, T., Globerson, A., Saenko, K., Hardt, M., Levine, S","venue":null,"work_id":"a76199a6-4e6a-46f1-887a-34ad04ee02ba","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:3a0ebfc9b59bad796c3d26a90560a2abe67725238f138283809ad893a4d2fc25","observation_id":"a7f171b3-2d44-485e-a955-eface99eb454","resolution":{"observed_at":"2026-05-23T20:43:25.999040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8fd38814-4e74-4106-b2bf-e4fd5388ec5e","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:0c7ab8ccf2f972fb879a631c54b0a5f2a7cf7b51fc6944b84c743e044b5ac4df","observation_id":"6bc833e1-40c4-4d0b-9413-0e52099299c5","resolution":{"observed_at":"2026-05-23T20:43:25.988537Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Journal of Pacific Rim Psychology (2023)","venue":null,"work_id":"ea173824-dfb4-4b5e-8e5f-2b785c25ec98","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:02cacce655837968e3c96af36b24706a2246b47d7181eb229653ffe1ff2ab47e","observation_id":"c137493b-40b2-4d49-8b85-46c6e7c2f4a6","resolution":{"observed_at":"2026-05-23T20:43:25.991840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06364","last_updated":"2023-09-18T14:23:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-13T09:39:30Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","version":2},"cited_work":{"arxiv_id":"2304.06364","doi":"10.48550/arxiv.2304.06364","metadata_source":"pith","pith_arxiv_id":"2304.06364","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"AGIEval: A Human-Centric Benchmark for Evaluating Foundation Models","venue":"cs.CL","work_id":"d42c58d5-eeb0-462a-92ab-3081ee269e59","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2304.06364","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:94474a36f5abc5b06f38c09fecfeee60d1d143aa53210bc041ad974b158052e2","observation_id":"3f745850-9722-42c9-9057-9f449b0d9d04","resolution":{"observed_at":"2026-05-23T20:43:25.254645Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02415","last_updated":"2024-05-30T04:45:34Z","snapshot_observed_at":"2026-07-06T17:11:42.641129Z","submitted_at":"2024-01-04T18:59:12Z","title":"LLaMA Pro: Progressive LLaMA with Block Expansion","version":2},"cited_work":{"arxiv_id":"2401.02415","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2401.02415","snapshot_observed_at":"2026-07-03T16:48:39.947407Z","title":"Llama pro: Progressive llama with block expansion.arXiv preprint arXiv:2401.02415","venue":null,"work_id":"188119f4-d2a8-4a4d-b38a-52f6d79684c7","year":2024},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2401.02415","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:46fc64a8e860098825e4eff04b33a8ebd6221a98bbd8019f0dbb1682a3284d89","observation_id":"0bad5256-d95e-4176-a3b8-ed8d58cd68bb","resolution":{"observed_at":"2026-05-23T20:43:25.247611Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"438650d7-7931-46e0-afce-8dfbc9197b47","year":2020},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:63e349c60c4a986d2f9268ed569971b87f75fa0a780cdb1072698e0919ca7fc5","observation_id":"bc964ceb-b6de-4e1a-8911-33b2a05c001b","resolution":{"observed_at":"2026-05-23T20:43:25.995551Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Technical report, Alibaba Group (2024)","venue":null,"work_id":"c1e42f9d-65f4-4734-924f-7ad7573325bb","year":2024},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:3430015115a77e44049996b696b6160b9e348c37a1471127c4e07ea552d62df5","observation_id":"bebf8430-e8ca-4440-81ba-e21423839e8a","resolution":{"observed_at":"2026-05-23T20:43:26.005705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d5164cd5-7295-43f5-a940-a759a8bb042c","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:c479124a30f0bc1fe6a98f57d6a9ec4cc1f98762e0c71492d1d03b5884cfac06","observation_id":"f102d1f1-0ba0-4e93-ad9f-931d7053bba2","resolution":{"observed_at":"2026-05-23T20:43:25.985026Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ea69154c-2cb5-4dc8-9224-a622235fa4a1","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:703a596e916abcddd2e26deea2a81e6b8caae6bb363e85c9f471680ea56da518","observation_id":"1035dacd-e1cf-4c84-bdc5-53f2011948b2","resolution":{"observed_at":"2026-05-23T20:43:25.981746Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.08322","last_updated":"2023-11-06T13:24:16Z","snapshot_observed_at":"2026-07-06T15:27:06.126421Z","submitted_at":"2023-05-15T03:20:19Z","title":"C-Eval: A Multi-Level Multi-Discipline Chinese Evaluation Suite for Foundation Models","version":3},"cited_work":{"arxiv_id":"2305.08322","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.08322","snapshot_observed_at":"2026-07-03T20:48:56.200978Z","title":"C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models","venue":null,"work_id":"61dc95c3-d071-4ec6-9d31-ea0610192fde","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2305.08322","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:f65ac1608750d9196ae23e792942a44ec51190d0319eff65f9c2b9399e9b530f","observation_id":"731cb606-f0c0-4e39-9ea5-97b50134f3ac","resolution":{"observed_at":"2026-05-23T20:43:25.242108Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09696","last_updated":"2023-05-16T06:37:38Z","snapshot_observed_at":"2026-07-06T15:28:20.821441Z","submitted_at":"2023-05-16T06:37:38Z","title":"Generative Table Pre-training Empowers Models for Tabular Prediction","version":1},"cited_work":{"arxiv_id":"2305.09696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.09696","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0fad9d55-2702-4690-94d0-8f8da6a526cd","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2305.09696","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:9cf88f84152964441188457ecd7b850d3c9694bd8eebb2136f615fd8be3bdc2b","observation_id":"8e1d1755-a092-401e-8426-37f2da41c35e","resolution":{"observed_at":"2026-05-23T20:43:25.260113Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In: ACL (2024)","venue":null,"work_id":"f76168cb-2cf7-4c89-bca9-348f62f03e76","year":2024},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:02a906a045a768ee6e9737e7854d4240f9dbbc8c756ca4c290dafa6d6ff3c6ca","observation_id":"667e76b2-a9bd-4e7d-b16f-938a346a2ef7","resolution":{"observed_at":"2026-05-23T20:43:26.002370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12701","last_updated":"2023-05-11T09:48:55Z","snapshot_observed_at":"2026-07-06T14:22:00.790764Z","submitted_at":"2022-11-23T04:46:28Z","title":"Continual Learning of Natural Language Processing Tasks: A Survey","version":2},"cited_work":{"arxiv_id":"2211.12701","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2211.12701","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Continual learning of natural language processing tasks: A survey","venue":null,"work_id":"5591b22e-4161-4910-8c7d-6dc8411e36b8","year":2023},"citing_paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-23T20:42:38.782232Z"},"links":{"cited_paper":"/paper/2211.12701","citing_paper":"/paper/2409.06624"},"observation_digest":"sha256:109b41ded6ec95d35453797fbbc7dfce178362a54ab2541d9086b734a75cedb5","observation_id":"67cad7a2-72a2-4d5b-a626-d9298a0eb81e","resolution":{"observed_at":"2026-05-23T20:43:25.236651Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-01T06:32:01.292127+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2409.06624","last_updated":"2026-04-29T15:56:44Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T19:13:16.067395Z","submitted_at":"2024-09-10T16:26:43Z","title":"A Practice of Post-Training on Llama-3 70B with Optimal Selection of Additional Language Mixture Ratio"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":20,"verified_fuzzy":7},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-01T06:32:01.292127+00:00","source":"crossref"},{"observed_at":"2026-08-01T06:31:58.492377+00:00","source":"retraction_watch"}],"thesis":"As of 2 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2409.06624."}