{"as_of":"2026-08-19T06:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cc571fd4eaf685612cd6bed65588f54b866d4e78b8d795050c6b187bfce25ea7","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T22:55:45.986790Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T05:02:18.347642Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:48:39.928976Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"cited_work":{"arxiv_id":"2505.05946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05946","snapshot_observed_at":"2026-07-03T16:48:39.928976Z","title":"Šliogeris, P","venue":null,"work_id":"6fb96369-c21d-47f5-9a51-815376db33d3","year":2025},"citing_paper":{"arxiv_id":"2605.15053","last_updated":"2026-05-15T02:16:20Z","snapshot_observed_at":"2026-08-15T10:10:11.114135Z","submitted_at":"2026-05-14T16:46:26Z","title":"TFGN: Task-Free, Replay-Free Continual Pre-Training Without Catastrophic Forgetting at LLM Scale","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-19T17:06:12.280460Z"},"links":{"cited_paper":"/paper/2505.05946","citing_paper":"/paper/2605.15053"},"observation_digest":"sha256:0b63ab855c2e1a0c77ea275ae3b88b2dbe50434958562aaeaee9491687d6290c","observation_id":"ceada456-ab38-4e67-9a76-b76b836438e7","resolution":{"observed_at":"2026-05-19T17:07:41.541141Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"cited_work":{"arxiv_id":"2505.05946","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.05946","snapshot_observed_at":"2026-07-03T16:48:39.928976Z","title":"Šliogeris, P","venue":null,"work_id":"6fb96369-c21d-47f5-9a51-815376db33d3","year":2025},"citing_paper":{"arxiv_id":"2606.24901","last_updated":"2026-06-12T13:44:48Z","snapshot_observed_at":"2026-08-03T03:21:51.293576Z","submitted_at":"2026-06-12T13:44:48Z","title":"LLM Evolution as an Industry-Scale Ecosystem: A Lifecycle Perspective on Continual Learning","version":1},"reference_index":150,"source":"pdf_text","source_observed_at":"2026-06-27T05:02:18.347642Z"},"links":{"cited_paper":"/paper/2505.05946","citing_paper":"/paper/2606.24901"},"observation_digest":"sha256:14d5e6e695e8965d46a5faa46457660f5d42732b842ed18d9f300bd26f8af94c","observation_id":"cdd7dc52-bb2c-4d2f-8962-77f272e28d1d","resolution":{"observed_at":"2026-07-03T16:48:39.930294Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.05946/citation-record","integrity":"/paper/2505.05946/integrity","json":"/paper/2505.05946/citation-record.json","paper":"/paper/2505.05946"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.520803Z","title":"Attention is all you need","venue":null,"work_id":"6ef4214e-328e-43d1-87e2-c04ce9103da2","year":2017},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.839211Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:f1ea19dab16ab9204cdf7a56790337cdfc5c9c7e09c9b24e1e0b5e3295f582bf","observation_id":"e5dc1b4d-340e-4485-b6c0-eeaa64e97972","resolution":{"observed_at":"2026-08-15T22:55:46.525323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.506753Z","title":"Bring Your Own Knowledge: A Survey of Methods for LLM Knowledge Expansion, 2025","venue":null,"work_id":"cffa415d-89a1-484c-b05c-08c97cc20dc8","year":2025},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.844612Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:ea23e02c574157ef8a1c3c89fdf42c9998018e0ad1d30e15768a507d2d269393","observation_id":"82b5ce1d-8cea-4db4-a9a3-4c6145c21750","resolution":{"observed_at":"2026-08-15T22:55:46.511054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16789","last_updated":"2024-11-25T05:27:13Z","snapshot_observed_at":"2026-08-17T23:09:06.865859Z","submitted_at":"2024-04-25T17:38:57Z","title":"Continual Learning of Large Language Models: A Comprehensive Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16789","snapshot_observed_at":"2026-08-15T22:55:45.849387Z","title":"Continual learning of large language models: A comprehensive survey.arXiv preprint arXiv:2404.16789, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.849387Z"},"links":{"cited_paper":"/paper/2404.16789","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:633b875152151d1adfe54d574ce1ae4be9e9e83aa8c9a4dc74165da250978c18","observation_id":"d0acec44-9979-4bde-9d5f-3b714c70d28c","resolution":{"observed_at":"2026-08-15T22:55:45.849387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.492454Z","title":"The MIT Press, Cambridge, 1965","venue":null,"work_id":"6064000e-92fb-4e96-8982-a010b1f63f90","year":1965},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.854700Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:da1826eb1b2a96151b76343985b281fab5809dc829fcc1c61165c3c06ec150a7","observation_id":"1ba9bc21-6ca5-4d23-a298-34ad7dffefc3","resolution":{"observed_at":"2026-08-15T22:55:46.496916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.476625Z","title":"Overcoming Catastrophic Forgetting in Neural Networks.Proceedings of the national academy of sciences, 114(13):3521–3526, 2017","venue":null,"work_id":"378d2b01-7337-4a5c-a488-0485efffb9ff","year":2017},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.859707Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:c3a0ccd2d78fcf7aa7b81485a9b3d7a1a34a5e8b8c686f17430712821a6f5ef8","observation_id":"50ccf73e-11ea-4c52-99bf-90a2baf301be","resolution":{"observed_at":"2026-08-15T22:55:46.481460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02118","last_updated":"2024-10-02T06:32:10Z","snapshot_observed_at":"2026-08-17T23:10:47.862073Z","submitted_at":"2024-07-02T10:06:41Z","title":"Breaking Language Barriers: Cross-Lingual Continual Pre-Training at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02118","snapshot_observed_at":"2026-08-15T22:55:45.864261Z","title":"Breaking Language Barriers: Cross- Lingual Continual Pre-Training at Scale.arXiv preprint arXiv:2407.02118, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.864261Z"},"links":{"cited_paper":"/paper/2407.02118","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:44ed9e93f3f1d9db5ef06eb2450b8bcdca68a718a069edda570ec162df356401","observation_id":"11daf383-8223-4096-9b71-6234ddcdae9d","resolution":{"observed_at":"2026-08-15T22:55:45.864261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12393","last_updated":"2022-10-29T09:19:01Z","snapshot_observed_at":"2026-08-17T23:12:34.724053Z","submitted_at":"2022-05-24T22:53:34Z","title":"Fine-tuned Language Models are Continual Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12393","snapshot_observed_at":"2026-08-15T22:55:45.869630Z","title":"Fine-tuned language models are continual learn- ers.arXiv preprint arXiv:2205.12393, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.869630Z"},"links":{"cited_paper":"/paper/2205.12393","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:bdfebe01882a4122a5d23fd4143357ee2a2c6459be729d4401b646b22f4bdcd6","observation_id":"afbcb2d5-bdaa-489d-8914-ea1258c57fc7","resolution":{"observed_at":"2026-08-15T22:55:45.869630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08763","last_updated":"2024-09-04T16:13:18Z","snapshot_observed_at":"2026-08-16T14:10:04.613423Z","submitted_at":"2024-03-13T17:58:57Z","title":"Simple and Scalable Strategies to Continually Pre-train Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08763","snapshot_observed_at":"2026-08-15T22:55:45.874320Z","title":"Simple and scalable strategies to continually pre-train large language models.arXiv preprint arXiv:2403.08763, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.874320Z"},"links":{"cited_paper":"/paper/2403.08763","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:a33a0a0b80401bfd87e963ead4803b7525eb50add710c3f4c1de835ea157eed1","observation_id":"c87e7829-d4d4-42bb-b8a4-3c06c09805b7","resolution":{"observed_at":"2026-08-15T22:55:45.874320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.03329","last_updated":"2019-12-23T04:36:52Z","snapshot_observed_at":"2026-08-19T06:42:08.768594Z","submitted_at":"2019-09-07T20:17:34Z","title":"LAMOL: LAnguage MOdeling for Lifelong Language Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.03329","snapshot_observed_at":"2026-08-15T22:55:45.879138Z","title":"LAMOL: LAnguage MOdeling for Lifelong Language Learn- ing.arXiv preprint arXiv:1909.03329, 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.879138Z"},"links":{"cited_paper":"/paper/1909.03329","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:7f859e4d215fcddb5929d808848b1f9b92168c882f8ae621d21a0844aff00fcc","observation_id":"b1715bdd-a4a9-4a41-a736-060a0707cba3","resolution":{"observed_at":"2026-08-15T22:55:45.879138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.460589Z","title":"Learning Without Forgetting","venue":null,"work_id":"f3753cc9-a7ef-41f5-aeca-60bd9177a67a","year":2016},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.884064Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:0b80091f3923ce48a1647f226e917231dbdfe15f26a32dd0ccb3db47fe4d7029","observation_id":"4aac1fb0-96ed-434c-b2f5-c159df85c7b9","resolution":{"observed_at":"2026-08-15T22:55:46.465648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.445132Z","title":"Learning to solve NLP tasks in an incremental number of languages","venue":null,"work_id":"b4f838b0-1bb2-4275-bd69-5ef6ae9de7c2","year":2021},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.888388Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:aefa6f93bafc32d1eae739935daf0cd72fd4c045243344e0a391d07901c923ff","observation_id":"0a18f165-9e35-4ddc-8177-cd0202eb1982","resolution":{"observed_at":"2026-08-15T22:55:46.449852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.430294Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"0f61dab0-1023-46d7-9678-4c006bc4c2bf","year":2022},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.893289Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:2515d3e1cb3f9cae35494c9f7bb7a681a97f0f94aa9faa8bb4b60e93be1c7fdc","observation_id":"b9b2c15b-b3cc-41fd-80c1-366af21d704d","resolution":{"observed_at":"2026-08-15T22:55:46.434986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.415607Z","title":"CURLoRA: Stable LLM Continual Fine-Tuning and Catastrophic Forgetting Mitigation, 2024","venue":null,"work_id":"6558c221-2a3a-42f2-9807-c82864ef1485","year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.897774Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:0f0c5442c7b8298e02117b40415f9672e0bb7dd01b5565c367abb37e336eec63","observation_id":"be4ad56f-ed2c-4785-a315-76b278609598","resolution":{"observed_at":"2026-08-15T22:55:46.420189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.400170Z","title":"Language models meet world models: Embodied experiences enhance language models.Advances in Neural Information Process- ing Systems, 36:75392–75412, 2023","venue":null,"work_id":"6db19fae-4405-49e3-b818-86e632a5c1f2","year":2023},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.902511Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:a4a1e869d4fd315821946c8cc6067e8e2cd983763cfe06f9fceb5ee29584524c","observation_id":"b4a70fec-bc2a-4132-b0e8-851e5b0845a9","resolution":{"observed_at":"2026-08-15T22:55:46.405138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16252","last_updated":"2023-05-25T17:06:34Z","snapshot_observed_at":"2026-08-17T23:12:35.949435Z","submitted_at":"2023-05-25T17:06:34Z","title":"Overcoming Catastrophic Forgetting in Massively Multilingual Continual Learning","version":1},"cited_work":{"arxiv_id":"2305.16252","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.16252","snapshot_observed_at":"2026-08-15T22:55:46.147366Z","title":"Overcoming Catastrophic Forgetting in Massively Multilingual Continual Learning","venue":"cs.CL","work_id":"ab5db9e8-f9fb-4342-9991-711197af6600","year":2023},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.906968Z"},"links":{"cited_paper":"/paper/2305.16252","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:44c5f6a3b33c8655ffdb062fd293dbdd34587af3dee06ef2869279e1e6367e03","observation_id":"f45a1dd0-2145-4bad-8713-b9b723a27b0c","resolution":{"observed_at":"2026-08-15T22:55:46.152730Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.385460Z","title":"Unifying Importance Based Regularisation Methods for Continual Learning","venue":null,"work_id":"5456268a-ad0f-4803-938d-af7b01417958","year":null},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.911782Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:d2232723b0c177337abdfb2b697a2d31c88e9dde5c934062807775629074e51f","observation_id":"35cf8420-a712-4207-b0fc-bc9aad3f22b2","resolution":{"observed_at":"2026-08-15T22:55:46.390008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.368963Z","title":"van de Ven","venue":null,"work_id":"a538adaf-e017-4924-8afe-56b349780758","year":2025},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.916433Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:fd0accfbecd9188b1e8f220f02688789015a7ea5d72b90afff347b257a879d49","observation_id":"4b7969c5-532f-4591-9a44-cb181917839f","resolution":{"observed_at":"2026-08-15T22:55:46.374637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03129","last_updated":"2024-01-06T05:34:09Z","snapshot_observed_at":"2026-08-17T23:11:52.011149Z","submitted_at":"2024-01-06T05:34:09Z","title":"Examining Forgetting in Continual Pre-training of Aligned Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03129","snapshot_observed_at":"2026-08-15T22:55:45.920900Z","title":"Examining forgetting in continual pre-training of aligned large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.920900Z"},"links":{"cited_paper":"/paper/2401.03129","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:e9b90f00a6c792233fbe5223ae78757b9c978086283cabbb109af4e189fff4b4","observation_id":"f642ff60-0197-4dd5-b20a-0de9ba0a6605","resolution":{"observed_at":"2026-08-15T22:55:45.920900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-15T22:55:45.925472Z","title":"Gemma 2: Improving open language models at a practical size.arXiv preprint arXiv:2408.00118, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.925472Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:dc2ae02922115e235072619a2ca8024e4b0445874ef9ea675d630b1bd0d3e861","observation_id":"dd73bfee-9bfd-4836-b56f-55341cbfd7aa","resolution":{"observed_at":"2026-08-15T22:55:45.925472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09400","last_updated":"2023-09-17T23:49:10Z","snapshot_observed_at":"2026-08-16T14:59:58.353302Z","submitted_at":"2023-09-17T23:49:10Z","title":"CulturaX: A Cleaned, Enormous, and Multilingual Dataset for Large Language Models in 167 Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09400","snapshot_observed_at":"2026-08-15T22:55:45.930374Z","title":"Culturax: A cleaned, enormous, and multilingual dataset for large language models in 167 languages.arXiv preprint arXiv:2309.09400, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.930374Z"},"links":{"cited_paper":"/paper/2309.09400","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:c93dbcfdf29025483078a6d5fc0c2932f480461668441576bbe35508b643c516","observation_id":"f8619775-8d88-48de-aede-55cc71934158","resolution":{"observed_at":"2026-08-15T22:55:45.930374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.12963","last_updated":"2024-08-23T10:18:39Z","snapshot_observed_at":"2026-08-17T23:12:37.214969Z","submitted_at":"2024-08-23T10:18:39Z","title":"Open Llama2 Model for the Lithuanian Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.12963","snapshot_observed_at":"2026-08-15T22:55:45.935063Z","title":"Open Llama2 Model for the Lithuanian Language","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.935063Z"},"links":{"cited_paper":"/paper/2408.12963","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:815eb01da717d52cd3e8d07e8075066e865b9f539b301a1c40cb23bea5c49d9a","observation_id":"1010db17-f03f-4b60-b256-d71eb4ba6c20","resolution":{"observed_at":"2026-08-15T22:55:45.935063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.353901Z","title":"Open Llama2 Models for the Lithuanian Language","venue":null,"work_id":"d0fcbdbf-cbd5-44e6-ac8f-1747236628f6","year":2025},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.939626Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:6d70043698cebf4ce78d9630c0853a74ce854f96010180b8f225a45dc4245a6a","observation_id":"46c2bc39-d873-4557-9116-1bbd1280a35d","resolution":{"observed_at":"2026-08-15T22:55:46.358723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03952","last_updated":"2025-01-07T17:24:17Z","snapshot_observed_at":"2026-08-17T23:11:52.538556Z","submitted_at":"2025-01-07T17:24:17Z","title":"Localizing AI: Evaluating Open-Weight Language Models for Languages of Baltic States","version":1},"cited_work":{"arxiv_id":"2501.03952","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.03952","snapshot_observed_at":"2026-08-15T22:55:46.059163Z","title":"Localizing AI: Evaluating Open-Weight Language Models for Languages of Baltic States","venue":"cs.CL","work_id":"9c6c69d5-a733-455b-b905-c9aa7f6bf88d","year":2025},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.944143Z"},"links":{"cited_paper":"/paper/2501.03952","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:6f5ab959f51881b528a5c76ddf373a700b471e7f74a4530b5b1f2574342640e7","observation_id":"55dfaadb-56fb-4c26-8bdd-f836e10d5259","resolution":{"observed_at":"2026-08-15T22:55:46.066445Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.337691Z","title":"Align- ing AI With Shared Human Values.Proceedings of the International Conference on Learning Representations (ICLR), 2021","venue":null,"work_id":"9fc5cd71-ac70-4d25-b0af-6f9f2c71aa05","year":2021},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.948958Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:12a1280ba9cd803eaace6f16f3415886851d3bbd5bf3223f0b5c5184d71888dd","observation_id":"1c5527ce-923f-40fb-82bd-cdc2204e58a6","resolution":{"observed_at":"2026-08-15T22:55:46.343551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.321518Z","title":"Measuring Massive Multitask Language Understanding.Proceedings of the International Conference on Learn- ing Representations (ICLR), 2021","venue":null,"work_id":"296d3382-7276-44db-835d-e7b6434bd77d","year":2021},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.953447Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:54a4b401560da97822289ba1c3f36f17d779e52ec8181a7cf4ab5d94df34f959","observation_id":"fbb2e76e-b153-49db-be2d-cb1cb68e88d6","resolution":{"observed_at":"2026-08-15T22:55:46.326789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.304934Z","title":"The Belebele Benchmark: a Parallel Reading Comprehension Dataset in 122 Language Variants","venue":null,"work_id":"b5c95d18-e569-4700-8978-39717a741f43","year":2024},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.957960Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:eac0fa97a2485ab1aa01d7f49a9ac405c467f25e4915d7791b6ae51735be11ee","observation_id":"7904a22f-f143-410a-817a-d1ecd5b43ba1","resolution":{"observed_at":"2026-08-15T22:55:46.310535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T22:55:45.962563Z","title":"Training Verifiers to Solve Math Word Problems.arXiv preprint arXiv:2110.14168, 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.962563Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:c62c4e35e6efa02f48a32ff48682280042420e8dca3cf55b0c0b0f3f9aeebc01","observation_id":"3a1c596b-a8d1-4605-ab35-95297da8aa0b","resolution":{"observed_at":"2026-08-15T22:55:45.962563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.289652Z","title":"HellaSwag: Can a Machine Re- ally Finish Your Sentence? InProceedings of the 57th Annual Meeting of the Association for Computational Linguistics, 2019","venue":null,"work_id":"9806e3a4-5ab7-461a-a223-ec88f9446a56","year":2019},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.968043Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:df0df537716cb723fab9b012422d2583fb973060e1da4e6c328537f00345c03c","observation_id":"2607462f-48a4-4ab3-935d-56a9f8e7245b","resolution":{"observed_at":"2026-08-15T22:55:46.294473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-15T22:55:45.972656Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge.arXiv:1803.05457v1, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.972656Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:e504d271a51ddebf160fc1df68e85ff38682a3e0679897ea54d90685b181f28b","observation_id":"f34f9659-586c-4152-97fc-962a851e78f1","resolution":{"observed_at":"2026-08-15T22:55:45.972656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.273958Z","title":"TruthfulQA: Measuring How Models Mimic Human Falsehoods, 2021","venue":null,"work_id":"582129f9-00f9-47a8-bb89-1bb88286732e","year":2021},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.977471Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:d3205e21e748019b41f1b73820035cbf7075607cc507a5d51a97c6bbde218498","observation_id":"2e8c0c0b-6045-4134-8be8-5dacd86a329c","resolution":{"observed_at":"2026-08-15T22:55:46.278949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.257815Z","title":"WinoGrande: An Adversarial Wino- grad Schema Challenge at Scale","venue":null,"work_id":"29d43dc2-39d4-47e4-a552-e08108af4c16","year":2019},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.982134Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:d35b4f02f65358e24921540d32eab2d2545976e51f27a54f73c8c9e2a827aca6","observation_id":"2452316c-e0b8-44e1-8dbd-b9851b774e45","resolution":{"observed_at":"2026-08-15T22:55:46.263222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T22:55:46.242633Z","title":"Fine-tuned","venue":null,"work_id":"c2efc896-23ce-4c0d-a5d4-775ed5f85986","year":2023},"citing_paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T22:55:45.986790Z"},"links":{"citing_paper":"/paper/2505.05946"},"observation_digest":"sha256:81e3b233213c1b5c72cd5813ca2435040537db7ba2bfb0f44e0d966c98b2ee3f","observation_id":"0f505a17-c735-41c2-9ee5-498617789b14","resolution":{"observed_at":"2026-08-15T22:55:46.247316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.05946","last_updated":"2025-06-05T11:13:42Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T00:43:32.792413Z","submitted_at":"2025-05-09T10:43:37Z","title":"Full-Parameter Continual Pretraining of Gemma2: Insights into Fluency and Domain Knowledge"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":19},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 2 inbound Pith citation observations for arXiv:2505.05946."}