{"as_of":"2026-08-08T04:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b84cece957f26dfe01a4bbe95fcddcf0fe1c43d79b2cbdff122315e6c9f72adb","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:25:05.152317Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.22018/citation-record","integrity":"/paper/2505.22018/integrity","json":"/paper/2505.22018/citation-record.json","paper":"/paper/2505.22018"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T13:24:59.676918Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:24:59.676918Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:8e57053c31f8113b8ca8ac681e0d5c72b281c139cafb9f5dcce7cab5b9625d27","observation_id":"92f2fc70-e8d8-42e0-89ee-728afc4b7fdd","resolution":{"observed_at":"2026-08-07T13:24:59.676918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:24:59.736835Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:24:59.736835Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:4cb7299b7d07a8c1e5158a59c18759f18360b1b83f67a02b55d0be0b56429994","observation_id":"b004c923-9a57-463c-96a1-64ae616702f3","resolution":{"observed_at":"2026-08-07T13:24:59.736835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9591.33597","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:06.540898Z","title":null,"venue":null,"work_id":"64ab67a7-a33f-4ec0-ad73-22f8a6350bae","year":2019},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:24:59.841217Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:22e69fd3612bfc0f0340333325581e637a0a6fcdae82fe1c3155ca5e3c13c84e","observation_id":"26410cd8-a3eb-46a2-bffe-f6d7f50892e1","resolution":{"observed_at":"2026-08-07T13:25:06.654078Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:24:59.933948Z","title":"Costa-jussà","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:24:59.933948Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:14620e1030d5c7d4d18596bda838c3fe363b1c01c25105d0fd26a211bb701dd0","observation_id":"e36e94ea-7b06-418a-a9d4-e3b8a53a49d2","resolution":{"observed_at":"2026-08-07T13:24:59.933948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9842.35985","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:06.340075Z","title":"Boyer and J","venue":null,"work_id":"35d45814-d42f-491d-a430-b063999b322f","year":1977},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.029243Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:148e61772d118530d3eca554124043a87d7863979b3d7f0e8ce75316e3753643","observation_id":"c66c8e11-3bf7-4adb-b54e-796987c13763","resolution":{"observed_at":"2026-08-07T13:25:06.404060Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:00.120185Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.120185Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:70dcba889794f2b8e9fb60837cbf6d1308c888af114b66bef7bb07a24fa76eaf","observation_id":"1a39fd97-33bc-4cea-84d1-d0496a6a7bd1","resolution":{"observed_at":"2026-08-07T13:25:00.120185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18743","last_updated":"2024-07-26T13:55:21Z","snapshot_observed_at":"2026-08-05T13:17:14.583922Z","submitted_at":"2024-07-26T13:55:21Z","title":"Towards Effective and Efficient Continual Pre-training of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18743","snapshot_observed_at":"2026-08-07T13:25:00.220733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.220733Z"},"links":{"cited_paper":"/paper/2407.18743","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:6cd400c5157e039864fa8a16995892b0955d439e963ba51c38db1ddd1f01207f","observation_id":"9965d01f-0f52-44ea-9354-bed045e93516","resolution":{"observed_at":"2026-08-07T13:25:00.220733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:00.331856Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.331856Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:a7b3e65118567a2744724953804ced7110c27ef52d14710f5b790ac9527d2dd3","observation_id":"89026870-3bbf-4593-bf2c-02486f18f52e","resolution":{"observed_at":"2026-08-07T13:25:00.331856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:00.440060Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.440060Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:989ed0856cf33ab3ec6964dc30bb6573f453fde58f8957ea1578cfe95f9fe310","observation_id":"00c14430-4a20-4df0-8076-2d983ca345f0","resolution":{"observed_at":"2026-08-07T13:25:00.440060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:10.342239Z","title":null,"venue":null,"work_id":"5f277729-e632-44b1-8856-7031c6caf46d","year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.516146Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:e96c4a2d31b1944d1c28cc1ba2cfd15ea2b2ffe4dc3eead7fdb1d668ee2141b6","observation_id":"38138892-a045-4505-9c53-52c31473666a","resolution":{"observed_at":"2026-08-07T13:25:10.468103Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:25:00.624095Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.624095Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:25df06c9246d2cf106e5ab9196d3c5527f79ad0989269d8a6a74e0d693eabd08","observation_id":"787e83a2-23ea-47f7-819a-9baab3792d60","resolution":{"observed_at":"2026-08-07T13:25:00.624095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:10.125279Z","title":null,"venue":null,"work_id":"3274e5ba-8999-4fca-a515-4653ef19c9e6","year":1971},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.735772Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:e256ea848440996ad6f31e20deb0f479578f5d413531df83d43414f93f572322","observation_id":"d17f958d-5336-42f5-9d60-3bbd472d1abe","resolution":{"observed_at":"2026-08-07T13:25:10.215021Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:09.879985Z","title":null,"venue":null,"work_id":"6ca5a121-44aa-456e-83c8-ab96ae114c57","year":1999},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.828386Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:250484302c9395399409543c45f53a0c96f0060d4c8e62cb73360ffdea80d1ea","observation_id":"79f2530c-4024-4eed-9247-bf2f3e5e290a","resolution":{"observed_at":"2026-08-07T13:25:10.028214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:09.596548Z","title":null,"venue":null,"work_id":"337e3e7a-21b4-491d-a46f-6ffab5e64a05","year":2006},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:00.943099Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:6802ac1a6b62b0aa1fe07dde325a34942dc6a5a1e3b39f752b5c34ed5b91e8aa","observation_id":"ccafde16-78be-4b74-8e4e-1fca52dd7f30","resolution":{"observed_at":"2026-08-07T13:25:09.749520Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:09.401628Z","title":null,"venue":null,"work_id":"55044b30-6d23-4c12-8d29-fdacb23b216b","year":2005},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:01.046071Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:3a704a133e4ea82c15b8596037317823612271978e1b58900a892cf47132e834","observation_id":"b9de8ab2-3836-4d89-b264-e79a13d58e9c","resolution":{"observed_at":"2026-08-07T13:25:09.509834Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:09.220011Z","title":null,"venue":null,"work_id":"a900c556-f903-4864-b87e-3d9a4a950165","year":2023},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:01.175942Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:3e1d9264f8c3dfb6b4579976974d823ec8bde772c37e93256dbf462a81feda21","observation_id":"e9f16a7f-8448-47a4-b992-5bc174a8c97d","resolution":{"observed_at":"2026-08-07T13:25:09.318192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:01.261255Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:01.261255Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:fb6f0e08cea672a598b2b5802aa2c5c13191e7ea8f9406f9c3ce2ad43bb0837b","observation_id":"bc8533c7-a898-470d-aec7-9b243b06b119","resolution":{"observed_at":"2026-08-07T13:25:01.261255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:01.381077Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:01.381077Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:32e623aab8aedaf40307b800b127109c4484ff093fcfe4b90b4eb8fb4a4dfd5a","observation_id":"fcf73207-2782-49df-8cf0-d672817812db","resolution":{"observed_at":"2026-08-07T13:25:01.381077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.208","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:05.840368Z","title":null,"venue":null,"work_id":"d0a61ec9-763b-49bf-a477-f3c42d587572","year":2023},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:01.510875Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:a06032681363e7593e16b0001086cfdd1c579a1d5f7c7360b99fd3707c579ed9","observation_id":"2082b4fd-66dd-417c-8f3d-d42634386211","resolution":{"observed_at":"2026-08-07T13:25:05.929853Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:09.084335Z","title":null,"venue":null,"work_id":"8880269b-5ae0-4ddc-a2d2-30c96d4e1423","year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:01.571968Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:97af68e13b69da69682f3eea8c28f541c070a1d50234f0363348c444e9858d16","observation_id":"899a1153-e334-4836-9ba1-b4274c8300eb","resolution":{"observed_at":"2026-08-07T13:25:09.149923Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:08.947807Z","title":null,"venue":null,"work_id":"22421c71-2783-4111-81a3-746bc147c992","year":2022},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:01.726327Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:d43eca791f893425ee6af1cf74a34b6f06900fb5f81ada10255ce73bf48f294b","observation_id":"f194c969-22cd-42cc-b439-409cbbaa4050","resolution":{"observed_at":"2026-08-07T13:25:09.026850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:08.792769Z","title":null,"venue":null,"work_id":"5a8c7d31-a1be-48fe-ae44-d915471af309","year":2018},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:01.843371Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:37ce284861817432958532718367969567667f0be847a019206d0514513b545b","observation_id":"9bd2ee53-802c-4223-ad8b-7d389609dbe3","resolution":{"observed_at":"2026-08-07T13:25:08.848746Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:01.960574Z","title":null,"venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:01.960574Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:193941e5c13ed527ba10225fedbfe19035ed339cf38ee73f8552581777b7d40a","observation_id":"138c23d1-b1d3-4c9d-9f1c-1d759e282e03","resolution":{"observed_at":"2026-08-07T13:25:01.960574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:08.619798Z","title":null,"venue":null,"work_id":"7fd59855-0894-4463-a5f2-29855265e6ab","year":1973},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:02.039449Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:56744ea0fd5c77c838257bc338649b880a3f1a23e54bbf07e81e4344e42f4e89","observation_id":"d04642e6-f87f-48c1-bf1b-a38f2e19acf0","resolution":{"observed_at":"2026-08-07T13:25:08.692847Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:08.433502Z","title":null,"venue":null,"work_id":"a4cab4a0-4457-4869-b483-489d31526f3a","year":1987},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:02.199314Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:c3052ba4da9a368b9297ba2b831c2146a7e8c1509980cd79c6a0a3cd30497504","observation_id":"fa298d58-05cf-4a78-9931-9c03e038f680","resolution":{"observed_at":"2026-08-07T13:25:08.537652Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:08.299301Z","title":null,"venue":null,"work_id":"5e3b5595-0eb7-46e2-85e8-3f681befe266","year":2023},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:02.322399Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:60131d296c38da6b72ae556d2b7b4ebcbcca49533a5796bf538701e05c5e7778","observation_id":"81271175-d08e-478e-8b79-79d3f9e39bf0","resolution":{"observed_at":"2026-08-07T13:25:08.362889Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/0898-1221(95)00153-p","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:05.624199Z","title":null,"venue":null,"work_id":"483787f6-417f-4ef4-bad7-7c84ccdf0c4c","year":1995},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:02.453492Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:14721cb120529f12280e240b7562d3a0845fe9d23bc56d59cbdf938a80dec9dc","observation_id":"01aa034a-441e-426b-8fdc-971fc3214d4e","resolution":{"observed_at":"2026-08-07T13:25:05.737312Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:08.105652Z","title":"Krallinger, O","venue":null,"work_id":"4f91de79-9568-4723-b6d8-caa354265dc0","year":2017},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:02.558203Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:e5c6a6e1422a503951e8ef88a7803ec8f025299fd1a64c127e01d41a3f7a54bd","observation_id":"3e858a97-754b-47a2-ba15-87cbe4ce7c94","resolution":{"observed_at":"2026-08-07T13:25:08.177595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.02027","last_updated":"2022-10-05T20:14:52Z","snapshot_observed_at":"2026-08-06T06:13:52.132620Z","submitted_at":"2021-06-29T04:37:23Z","title":"Efficient Sequence Packing without Cross-contamination: Accelerating Large Language Models without Impacting Performance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.02027","snapshot_observed_at":"2026-08-07T13:25:02.689938Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:02.689938Z"},"links":{"cited_paper":"/paper/2107.02027","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:d364fd7c2b0b5fc059b503c4684d0c6db485189825ea3f4594f6fcf6920cc30d","observation_id":"f6dddd43-912f-4594-baea-afd1cf0d7a60","resolution":{"observed_at":"2026-08-07T13:25:02.689938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:02.808286Z","title":null,"venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:02.808286Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:82f1d79de29c28855e83281302052d5f510cfc7665935d7805cce1d5c294b69a","observation_id":"438f3fd5-7b63-4465-8224-1f481cc4c58a","resolution":{"observed_at":"2026-08-07T13:25:02.808286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.05372","last_updated":"2020-03-12T23:58:56Z","snapshot_observed_at":"2026-07-06T08:43:46.907186Z","submitted_at":"2019-12-11T14:59:32Z","title":"FlauBERT: Unsupervised Language Model Pre-training for French","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.05372","snapshot_observed_at":"2026-08-07T13:25:02.906806Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:02.906806Z"},"links":{"cited_paper":"/paper/1912.05372","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:a7828c350275beb466e8142c3e7b1949a16f9acf7ba5503f9bb0b7f81bc61b0e","observation_id":"cb577b99-5eb0-4a35-8941-a8abae2f51e3","resolution":{"observed_at":"2026-08-07T13:25:02.906806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:03.054504Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:03.054504Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:87edc2a9bf6f9107794fab1d7a76643f390c8fac96b96b1c3d1cde185c3ca70e","observation_id":"c8d00175-406c-4230-b189-ec12b6ee7e48","resolution":{"observed_at":"2026-08-07T13:25:03.054504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.01678","last_updated":"2022-07-10T22:05:29Z","snapshot_observed_at":"2026-08-07T00:28:57.050301Z","submitted_at":"2021-04-04T19:48:16Z","title":"Understanding Continual Learning Settings with Data Distribution Drift Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.01678","snapshot_observed_at":"2026-08-07T13:25:03.182075Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:03.182075Z"},"links":{"cited_paper":"/paper/2104.01678","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:87e076e9b664be2f0d6aab8257c1505480a5dab57966cc0f35d5b20cf6af8fc2","observation_id":"ca5ae45f-72b3-42ba-bc76-f594636301c8","resolution":{"observed_at":"2026-08-07T13:25:03.182075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:07.944774Z","title":null,"venue":null,"work_id":"c974f35c-4901-4dda-9212-bb930ac6e94f","year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:03.286657Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:6063582a4e6da0d432859dbbd1930c74e36e52ef9c2fa5b5152ec060efaaedf3","observation_id":"e2a02158-2e15-475f-823c-653640b4e7c7","resolution":{"observed_at":"2026-08-07T13:25:08.000864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:03.398842Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:03.398842Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:f774379a262d497c67cc5756f320ee5c37a26e070095484d915a8e03d46178c8","observation_id":"cd03761c-cfe0-40de-9f6c-357de86f7a37","resolution":{"observed_at":"2026-08-07T13:25:03.398842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:03.501519Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:03.501519Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:1c6db061123659ac8d4f9e8fc6ba7b8813bbeaa4766e6ae6e7c837d2180ca85b","observation_id":"b1417c11-1d25-4439-b88e-9982ce3923bc","resolution":{"observed_at":"2026-08-07T13:25:03.501519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:07.755185Z","title":null,"venue":null,"work_id":"20656226-0cf3-4081-8958-849c0e5d304f","year":2014},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:03.616972Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:9928fa23a12a361ecab2ecd9ef85b3f639f97eff09c5c202e8174a38c20992eb","observation_id":"be855d3e-9967-4a95-bda2-5709a265ed9a","resolution":{"observed_at":"2026-08-07T13:25:07.839450Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/0166-218x(90)90094-s","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:05.417033Z","title":null,"venue":null,"work_id":"aba3f1cd-fa77-401f-8e86-c319b520de18","year":1990},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:03.710148Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:59f4fb58612b7de21c12b75e2bbb57cb903d360f4e8ac336dc1b9f7c3b33c199","observation_id":"d93ba135-222c-4a13-a92b-4e6cf5a83353","resolution":{"observed_at":"2026-08-07T13:25:05.480613Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:07.516870Z","title":null,"venue":null,"work_id":"831fe27c-8882-4ac2-b91a-f78ff512875e","year":2023},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:03.812862Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:c0fab4930e1df216fd138ae7845193608988fd7f5fea110fb0db3765ce440546","observation_id":"8230eb59-30ef-43b0-80bc-8520dadeb562","resolution":{"observed_at":"2026-08-07T13:25:07.638379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.deelio-1.5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:05.248791Z","title":null,"venue":null,"work_id":"56647b28-68f4-4d2f-bd49-8de6fbfb9c89","year":2021},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:03.924546Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:a8f000015fd6f85464c3432049e7c9f68539f20a8e9a028be66cb3e7d58ede70","observation_id":"1e91dbab-5100-4063-abef-04dd2069613f","resolution":{"observed_at":"2026-08-07T13:25:05.337267Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07263","last_updated":"2024-07-09T22:37:59Z","snapshot_observed_at":"2026-08-07T09:28:48.845112Z","submitted_at":"2024-07-09T22:37:59Z","title":"Reuse, Don't Retrain: A Recipe for Continued Pretraining of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07263","snapshot_observed_at":"2026-08-07T13:25:04.031066Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.031066Z"},"links":{"cited_paper":"/paper/2407.07263","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:dd703e2439af94ef3d1070bfba7cc978001777c8f27309a2fedcff269b9b843e","observation_id":"b98ded42-805c-4d71-adf5-217622310fc2","resolution":{"observed_at":"2026-08-07T13:25:04.031066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:04.090902Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.090902Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:4a2be7bb76258401139cfd1a70b92e45f50f1288159bcf8f704a8f27ca95ac49","observation_id":"30916e74-654e-47c4-86b0-71df6dda2615","resolution":{"observed_at":"2026-08-07T13:25:04.090902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:04.148994Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.148994Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:795ef77347d0614900d592be4f1cca294de8a7dfc9df257e152599085b54b584","observation_id":"ae21b756-da91-45a4-bddf-b58a7093383b","resolution":{"observed_at":"2026-08-07T13:25:04.148994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:04.203057Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.203057Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:f1ad8c233996aa78584442df1bce0ab3d75152a54683f38db12d6ae2b5823100","observation_id":"f1e29ea3-a743-4d07-8447-13104507e25d","resolution":{"observed_at":"2026-08-07T13:25:04.203057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:07.275491Z","title":null,"venue":null,"work_id":"7e6aed42-22a1-480b-825a-bd49180184e5","year":1995},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.305406Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:549068bb5b4cce863f8a52a875d51952d8ca1ce3132cd345e0d5684f1101dbff","observation_id":"15656ce3-d042-45b1-b649-bfc7fb60b04d","resolution":{"observed_at":"2026-08-07T13:25:07.369516Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:07.093765Z","title":"Smith, Luke Zettlemoyer, Wen tau Yih, and Mike Lewis","venue":null,"work_id":"04175ad7-4925-4b8b-aead-5bda40eb31fc","year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.412077Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:cd8ced75e9da8e4ee70b3df2e991d0a5bb31fa9e7d490e8d8876c71f76459d7c","observation_id":"c73cd322-8381-4659-ba63-b2fd63497325","resolution":{"observed_at":"2026-08-07T13:25:07.165121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T13:25:04.480465Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.480465Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:db72e3c332e562cacbed91b9ce34ca58c79572ad5e733f9cd797437dfcef2e42","observation_id":"e113d8cb-77ae-4546-84f6-71c7c347fda1","resolution":{"observed_at":"2026-08-07T13:25:04.480465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T13:25:04.553625Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.553625Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:58cd6f007a9b6da0a09463e7b75b131473c5218b13e2809907183cd855f434cd","observation_id":"5f35ab69-25b5-4ef1-92b9-c1687da44f25","resolution":{"observed_at":"2026-08-07T13:25:04.553625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:04.625166Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.625166Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:2b36d4795ee8f7f4aef5d2bf55dab50221f10b8c0260f99f70b16a2e8cf4b06e","observation_id":"c5f8d19b-2ac5-4877-bfc3-f9b6cb8aec8a","resolution":{"observed_at":"2026-08-07T13:25:04.625166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:04.679588Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.679588Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:c3160b5499b99563d35d6893769806c4b6013511fb89551d066186a6586a529a","observation_id":"82b8221f-4315-49a8-9c78-f747fe03e3cb","resolution":{"observed_at":"2026-08-07T13:25:04.679588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:06.815222Z","title":null,"venue":null,"work_id":"7f8e8c63-6bd3-4268-a65a-942ca213a7ec","year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.745630Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:12029b975204f05192d0e1934eb705fdb5d10ba97b093fed1a6f3eb02f150710","observation_id":"b9e68ba9-24ce-437e-beb2-12ada606bede","resolution":{"observed_at":"2026-08-07T13:25:06.949945Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:04.825655Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.825655Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:42a6bef5da3949cd53a05d9a2be87b3ed9ae5efc3436934f069f2318a8e1ad40","observation_id":"d53ccaee-9b4d-4643-ad30-b9cc3ff75d09","resolution":{"observed_at":"2026-08-07T13:25:04.825655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T13:25:04.888904Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.888904Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:a1cf22ac9586f74ee7465c9d06ae27b66cc2c87d21c2789b00a444eb71f15113","observation_id":"bf3348ec-a857-40b5-a44f-ba1bd9958e23","resolution":{"observed_at":"2026-08-07T13:25:04.888904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T13:25:04.969013Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:04.969013Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:4cb2c4c03be20eff1922dc7c45841cf31066976cf7417d381b822b7a276adc13","observation_id":"66623d61-b2f3-43c3-b73b-f17d713e2447","resolution":{"observed_at":"2026-08-07T13:25:04.969013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17400","last_updated":"2025-02-12T14:46:43Z","snapshot_observed_at":"2026-07-06T17:36:05.934286Z","submitted_at":"2024-02-27T10:47:24Z","title":"Investigating Continual Pretraining in Large Language Models: Insights and Implications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17400","snapshot_observed_at":"2026-08-07T13:25:05.038672Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:05.038672Z"},"links":{"cited_paper":"/paper/2402.17400","citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:fadceeee81b1912be92a15e8897a9101024e36142fc3b461dd943cc862fb64d2","observation_id":"24b41f8c-5fc7-4375-9292-71df5dded36e","resolution":{"observed_at":"2026-08-07T13:25:05.038672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:05.101221Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:05.101221Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:7d51925b6d121223c4ae6ec62d5dfe89ff55dedd52d21931988120c0b4cf6294","observation_id":"4f43dfeb-6ce1-4d6f-af02-c4c3e77efc9c","resolution":{"observed_at":"2026-08-07T13:25:05.101221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:25:05.152317Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T13:25:05.152317Z"},"links":{"citing_paper":"/paper/2505.22018"},"observation_digest":"sha256:29053129f5fdd012deecfde4020b74d52a3e32db398178235ae7c7ba093f98ff","observation_id":"337305d1-9e2f-45ab-8338-bbc4ac70082d","resolution":{"observed_at":"2026-08-07T13:25:05.152317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22018","last_updated":"2025-05-29T07:20:02Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T13:14:56.690892Z","submitted_at":"2025-05-28T06:30:37Z","title":"Improving Continual Pre-training Through Seamless Data Packing"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":49,"verified_exact":4,"verified_fuzzy":2},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2505.22018."}