{"as_of":"2026-08-17T17:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9997abd7e98b762f8b363fe2b2dc3930bd08f8283ceb83f7132fee1046df47c5","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T19:47:59.758998Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.15138/citation-record","integrity":"/paper/2506.15138/integrity","json":"/paper/2506.15138/citation-record.json","paper":"/paper/2506.15138"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T19:47:59.499219Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.499219Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:37954a1034b91ce3b57b74428fb425bb2c80efb288e4c21fef0fcf16e41b76b4","observation_id":"85669550-fee2-48d9-8eb3-2cd6c9637e2c","resolution":{"observed_at":"2026-08-15T19:47:59.499219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:48:00.781546Z","title":null,"venue":null,"work_id":"0204a535-4267-42cb-ab50-7a7466c07cbe","year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.505410Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:92b91de9b02c0fbc15a387ef66ab8aff99db877026b3ba48bc3baf5a5393f072","observation_id":"2789bf8d-326b-439d-90f7-2be9a4f7d70f","resolution":{"observed_at":"2026-08-15T19:48:00.787349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-15T19:47:59.510842Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.510842Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:aa2dc0767c5ffd385411d4a4a7e6c9ecf0a352dad527507502653a6cd934ee01","observation_id":"bae2c230-d894-4273-8add-201038cd7414","resolution":{"observed_at":"2026-08-15T19:47:59.510842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03258","last_updated":"2024-10-04T09:24:55Z","snapshot_observed_at":"2026-08-17T12:57:04.924020Z","submitted_at":"2024-10-04T09:24:55Z","title":"Adaptive BPE Tokenization for Enhanced Vocabulary Adaptation in Finetuning Pretrained Language Models","version":1},"cited_work":{"arxiv_id":"2410.03258","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.03258","snapshot_observed_at":"2026-08-15T19:48:00.419599Z","title":"Adaptive BPE Tokenization for Enhanced Vocabulary Adaptation in Finetuning Pretrained Language Models","venue":"cs.CL","work_id":"7f2c82c3-c252-40a3-a490-b752f24231c1","year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.516357Z"},"links":{"cited_paper":"/paper/2410.03258","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:f7c161bafbfaf3b858c65ad5c0b9970e3e8297384472e6a16c8fc36a25954d97","observation_id":"9e77dd50-a44c-48a7-b785-bd61375af239","resolution":{"observed_at":"2026-08-15T19:48:00.424811Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10267","last_updated":"2025-06-04T12:57:58Z","snapshot_observed_at":"2026-08-16T12:50:25.088186Z","submitted_at":"2025-03-13T11:24:09Z","title":"An Expanded Massive Multilingual Dataset for High-Performance Language Technologies (HPLT)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10267","snapshot_observed_at":"2026-08-15T19:47:59.521940Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.521940Z"},"links":{"cited_paper":"/paper/2503.10267","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:8cdc9599bce113a4b5124c52759e715952cc3ff2ba6401e05d1dd97d16890576","observation_id":"cffd4828-c8e9-46fe-b940-8aa8ad98e616","resolution":{"observed_at":"2026-08-15T19:47:59.521940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-15T19:47:59.528528Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.528528Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:e168bd8040f8839212fe87642201fa977dafd41e210139e43d68a27e15ca0016","observation_id":"733101f7-8814-4f71-8912-486b9cbbf11c","resolution":{"observed_at":"2026-08-15T19:47:59.528528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01035","last_updated":"2024-02-07T10:51:11Z","snapshot_observed_at":"2026-08-16T14:22:19.860189Z","submitted_at":"2024-02-01T21:49:34Z","title":"Getting the most out of your tokenizer for pre-training and domain adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01035","snapshot_observed_at":"2026-08-15T19:47:59.534351Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.534351Z"},"links":{"cited_paper":"/paper/2402.01035","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:3e1df5c6d1040b748bdf5a909f61d078f49ed791cae43aeeedb58f188ef661f1","observation_id":"db4457e3-6252-4afe-9da5-762f96a9ae02","resolution":{"observed_at":"2026-08-15T19:47:59.534351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.539506Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.539506Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:5f7fe8d738c1b1fca611da20b8f877b3589c0ec05fbb1e1a294a7b82b527e6cf","observation_id":"341c825e-1042-437d-a958-29bc7bbea7c7","resolution":{"observed_at":"2026-08-15T19:47:59.539506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09572","last_updated":"2023-06-16T01:22:32Z","snapshot_observed_at":"2026-08-16T15:23:28.205268Z","submitted_at":"2023-06-16T01:22:32Z","title":"How do different tokenizers perform on downstream tasks in scriptio continua languages?: A case study in Japanese","version":1},"cited_work":{"arxiv_id":"2306.09572","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.09572","snapshot_observed_at":"2026-08-15T19:48:00.348518Z","title":"How do different tokenizers perform on downstream tasks in scriptio continua languages?: A case study in Japanese","venue":"cs.CL","work_id":"322af98f-1a38-4877-ba6e-83f835557fcd","year":2023},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.544491Z"},"links":{"cited_paper":"/paper/2306.09572","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:29f4c453094880b86ebdf2e3544a386852f9c7c02b0e4c68eb14c04d97498afe","observation_id":"0a21da18-f050-4a52-be61-65550e9a292c","resolution":{"observed_at":"2026-08-15T19:48:00.353839Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.549720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.549720Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:b53d745386451a24b12899ed8def2fac3ff4ccecccdcccdbb3b4ea815e4347ad","observation_id":"8f92c986-c3c4-4fba-9b24-99655f8dd1ba","resolution":{"observed_at":"2026-08-15T19:47:59.549720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06265","last_updated":"2024-06-22T16:00:49Z","snapshot_observed_at":"2026-08-16T14:11:12.034173Z","submitted_at":"2024-03-10T17:02:53Z","title":"Unpacking Tokenization: Evaluating Text Compression and its Correlation with Model Performance","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06265","snapshot_observed_at":"2026-08-15T19:47:59.554432Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.554432Z"},"links":{"cited_paper":"/paper/2403.06265","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:00720bdc9471c92e2fe8e2b15da0d57340a2bf7705ba267f24465d58e1dc5e8d","observation_id":"9e8ff8d0-00ac-4026-a0e4-52813f9448d7","resolution":{"observed_at":"2026-08-15T19:47:59.554432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T19:47:59.559384Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.559384Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:1220a08b1b115a30fdf1712ab29e1fdbc69b67f782c5c9b940257ede2230a445","observation_id":"0f6d8bf5-a482-459c-8c63-882cf13e938a","resolution":{"observed_at":"2026-08-15T19:47:59.559384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T19:47:59.564377Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.564377Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:9ca3c125ae3fdc51013f21d42fa9320d4048cd68f22999a89642d68425cf9379","observation_id":"c4cec494-d386-4138-b3c1-2a5264af483b","resolution":{"observed_at":"2026-08-15T19:47:59.564377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:48:00.739223Z","title":null,"venue":null,"work_id":"00cc828c-cdc7-46bc-bf86-566c4d2a90bc","year":2022},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.569320Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:c0d96cdbe3de8f586133972528d88b40ff73c89e40e17c32e91e2b4db263847b","observation_id":"f78465ae-67c3-4c52-ab8c-63d03f45f7c2","resolution":{"observed_at":"2026-08-15T19:48:00.744252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.574424Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.574424Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:2c53b22f8eee97395099f41e36aa24d96dc059a4a5377790084a27efe6c98922","observation_id":"c3cf55d2-6958-439d-b7c5-068a4e2dd097","resolution":{"observed_at":"2026-08-15T19:47:59.574424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:48:00.709721Z","title":null,"venue":null,"work_id":"61000618-a3a0-401a-a389-da9838fd5662","year":2006},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.579652Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:738b63eea230be495a33abdfeb94ccdb6cd98a1538056bde4b74e2381b39bde8","observation_id":"73793c27-5a6b-456f-a8ca-52424b03b142","resolution":{"observed_at":"2026-08-15T19:48:00.714519Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.04650","last_updated":"2021-11-28T10:56:27Z","snapshot_observed_at":"2026-08-16T17:57:38.268815Z","submitted_at":"2021-09-10T03:32:19Z","title":"What Changes Can Large-scale Language Models Bring? Intensive Study on HyperCLOVA: Billions-scale Korean Generative Pretrained Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.04650","snapshot_observed_at":"2026-08-15T19:47:59.585032Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.585032Z"},"links":{"cited_paper":"/paper/2109.04650","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:3a450503c0074501a065bd37668001a12f8c99a142110dcfa494baedfafd3c9f","observation_id":"b62926b5-3e24-4dae-9b53-455cb89f8c62","resolution":{"observed_at":"2026-08-15T19:47:59.585032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.10959","last_updated":"2018-04-29T16:13:44Z","snapshot_observed_at":"2026-08-14T19:20:50.499180Z","submitted_at":"2018-04-29T16:13:44Z","title":"Subword Regularization: Improving Neural Network Translation Models with Multiple Subword Candidates","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.10959","snapshot_observed_at":"2026-08-15T19:47:59.590138Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.590138Z"},"links":{"cited_paper":"/paper/1804.10959","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:be2b71cf5ecd43ca7a00e6e144e54acf0c6bb2aa1e46850910d4466b46be19cf","observation_id":"b80bdba0-f3f6-4d44-b8a4-2ddea4b65272","resolution":{"observed_at":"2026-08-15T19:47:59.590138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.06226","last_updated":"2018-08-19T16:49:06Z","snapshot_observed_at":"2026-07-06T06:56:20.935388Z","submitted_at":"2018-08-19T16:49:06Z","title":"SentencePiece: A simple and language independent subword tokenizer and detokenizer for Neural Text Processing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.06226","snapshot_observed_at":"2026-08-15T19:47:59.595322Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.595322Z"},"links":{"cited_paper":"/paper/1808.06226","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:d80a544d0bd4d78fa841f96a9e04277f06b80db64387dec95d8cb6938200637e","observation_id":"13b715a8-d174-4b1e-b7c2-defd639c9e5a","resolution":{"observed_at":"2026-08-15T19:47:59.595322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:48:00.693568Z","title":null,"venue":null,"work_id":"06798ad8-8b3f-492d-952d-2cdf8cc1dc25","year":2023},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.600434Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:d935b0d2186ae8e6d791b0c587020b5287eefbb23ecb9cabe9cfe29f13c8d906","observation_id":"4f2780a0-6ce0-46ae-96f3-b5a5fc9d8b95","resolution":{"observed_at":"2026-08-15T19:48:00.698482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:48:00.677566Z","title":null,"venue":null,"work_id":"5046a749-3433-43d8-8e0d-d5be8fbd5e5f","year":2007},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.605729Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:0234b6cd76a13043122118ced73d5eebbb5b3f0072d40ed213a659a44cd2d7ac","observation_id":"270361d5-5b98-4203-8fac-23144bed1b1a","resolution":{"observed_at":"2026-08-15T19:48:00.682379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.610890Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.610890Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:02d84abce408de896407601a5f7847fba15a1fc02dda1dd2ca3d3289071b826c","observation_id":"2dc0644f-1ccb-4f32-8429-fc5979070045","resolution":{"observed_at":"2026-08-15T19:47:59.610890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-15T19:47:59.617025Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.617025Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:d6e91132bf9e88a0ee97bd40b7c02ce470162439085d33854d13c2a7c3dc0a50","observation_id":"98c41c12-dbd7-420c-9dae-edc9b3992592","resolution":{"observed_at":"2026-08-15T19:47:59.617025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-15T19:47:59.622788Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.622788Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:d7afc44bb728afa2b6f446d5aa194a259c5e9f5b7a5072d5673a6758e3d49821","observation_id":"62e473fe-81fb-4462-af56-a8d1079d6426","resolution":{"observed_at":"2026-08-15T19:47:59.622788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-15T19:47:59.628541Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.628541Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:fe4838f4ceb8cc9641cc65aec598f43da2a59a636b7a102c5aa8d375502336b4","observation_id":"7b87be74-0718-49c4-857b-bfd937bc2e48","resolution":{"observed_at":"2026-08-15T19:47:59.628541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:48:00.651189Z","title":"Meta Platforms","venue":null,"work_id":"5013a6aa-3606-4b51-9f8a-796b7187a0b1","year":2025},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.633677Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:854d3dd723e22db9b6e016d254b11354d3ca7c0001283033cb60ad8e5ed1ed97","observation_id":"fcd4ba1f-f441-4d7b-8a81-415fab548fc0","resolution":{"observed_at":"2026-08-15T19:48:00.656084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10508","last_updated":"2021-12-20T13:04:18Z","snapshot_observed_at":"2026-08-16T17:33:18.294291Z","submitted_at":"2021-12-20T13:04:18Z","title":"Between words and characters: A Brief History of Open-Vocabulary Modeling and Tokenization in NLP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10508","snapshot_observed_at":"2026-08-15T19:47:59.638067Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.638067Z"},"links":{"cited_paper":"/paper/2112.10508","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:2883e7c777a5683b8c6976a405ba183eeb50af0bd89244dc7dbb3d62b1904148","observation_id":"30f439af-c322-42e0-8f82-ad13eecbb48f","resolution":{"observed_at":"2026-08-15T19:47:59.638067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02534","last_updated":"2020-10-06T07:20:41Z","snapshot_observed_at":"2026-08-16T19:15:35.785182Z","submitted_at":"2020-10-06T07:20:41Z","title":"An Empirical Study of Tokenization Strategies for Various Korean NLP Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02534","snapshot_observed_at":"2026-08-15T19:47:59.643267Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.643267Z"},"links":{"cited_paper":"/paper/2010.02534","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:c1a48b29d40199a7a8da34d28dcdcd23970cce3407417f155f44ca1d678d567d","observation_id":"66be9740-471d-4b4d-8591-69fb407bb3b4","resolution":{"observed_at":"2026-08-15T19:47:59.643267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.649040Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.649040Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:1a795f730c4616a0d963c9f6123a6bdaaa0e7d48e6e70537619b0f189b6c77b9","observation_id":"3c7ce041-7597-47e7-9c25-1d27e7db5d9d","resolution":{"observed_at":"2026-08-15T19:47:59.649040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13267","last_updated":"2020-05-01T18:54:20Z","snapshot_observed_at":"2026-08-02T07:25:01.310491Z","submitted_at":"2019-10-29T13:42:56Z","title":"BPE-Dropout: Simple and Effective Subword Regularization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13267","snapshot_observed_at":"2026-08-15T19:47:59.656812Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.656812Z"},"links":{"cited_paper":"/paper/1910.13267","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:1d4e93f583a2b4c5b87e684bcb12e42a26cd942bac85741f341853b0e484939a","observation_id":"12210d51-8fdc-475c-9b85-d63debcaca45","resolution":{"observed_at":"2026-08-15T19:47:59.656812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10241","last_updated":"2023-11-30T10:40:34Z","snapshot_observed_at":"2026-08-16T14:38:53.295792Z","submitted_at":"2023-11-30T10:40:34Z","title":"Zero Bubble Pipeline Parallelism","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10241","snapshot_observed_at":"2026-08-15T19:47:59.661858Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.661858Z"},"links":{"cited_paper":"/paper/2401.10241","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:cc6b8012aaaf8b09bd4578dccb572aa4b16adb6373deb4587e11e15b26735d08","observation_id":"9e3d8d42-3a1e-4430-a935-f97cf2bc891e","resolution":{"observed_at":"2026-08-15T19:47:59.661858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.667109Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.667109Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:8f5295917f1085f2a0afd27cbbe7e265ee7f18db2c37f915a412d459c206cdcf","observation_id":"b095c7b8-2a11-43a3-8012-bdd2f98125ce","resolution":{"observed_at":"2026-08-15T19:47:59.667109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.672144Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.672144Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:1d2ffc3d46df57cca31673684a0f1a6dfd3c9ec02e4b876b110f5dc90d750c5a","observation_id":"ede2af3e-0a26-4c52-aa60-30649f6edb19","resolution":{"observed_at":"2026-08-15T19:47:59.672144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.677496Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.677496Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:d5295b39f62d6b2c026f78725bd7e6775ac62e2b2d0fc90b54dc9981d2db7418","observation_id":"b0920566-f3ef-480d-874d-79fc57e6e13e","resolution":{"observed_at":"2026-08-15T19:47:59.677496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.15613","last_updated":"2021-06-01T18:17:59Z","snapshot_observed_at":"2026-08-16T18:55:05.983035Z","submitted_at":"2020-12-31T14:11:00Z","title":"How Good is Your Tokenizer? On the Monolingual Performance of Multilingual Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.15613","snapshot_observed_at":"2026-08-15T19:47:59.682281Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.682281Z"},"links":{"cited_paper":"/paper/2012.15613","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:8b3fb9cca0cd15000a4d2a39140a650cf3f64d27e077c65aeb6ca1604d5e4c20","observation_id":"c48cd711-45f0-4228-95ad-5fb375a59087","resolution":{"observed_at":"2026-08-15T19:47:59.682281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18376","last_updated":"2024-10-07T13:17:03Z","snapshot_observed_at":"2026-08-16T14:14:30.685616Z","submitted_at":"2024-02-28T14:52:15Z","title":"Tokenization Is More Than Compression","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18376","snapshot_observed_at":"2026-08-15T19:47:59.687743Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.687743Z"},"links":{"cited_paper":"/paper/2402.18376","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:b9693611df447128c3b0c2556761cc118e52dbb6818934446ac4c70c44821ec3","observation_id":"a844923e-b48f-4ee3-af77-939855f6b295","resolution":{"observed_at":"2026-08-15T19:47:59.687743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.692744Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.692744Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:72c98cae167bef8d6c6600b8259cd67891e85e72fc6438c94692291d0c718099","observation_id":"663b83ba-8f9e-448f-974b-c2b492946fe7","resolution":{"observed_at":"2026-08-15T19:47:59.692744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.07909","last_updated":"2016-06-10T14:45:08Z","snapshot_observed_at":"2026-08-17T07:28:37.146698Z","submitted_at":"2015-08-31T16:37:31Z","title":"Neural Machine Translation of Rare Words with Subword Units","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.07909","snapshot_observed_at":"2026-08-15T19:47:59.697464Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.697464Z"},"links":{"cited_paper":"/paper/1508.07909","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:35cb6d55b03f11f7133eb8937d7dff24c072b943477d4828c403e0affa301055","observation_id":"5b6daecf-4ce1-44eb-874a-b68605080614","resolution":{"observed_at":"2026-08-15T19:47:59.697464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.702982Z","title":null,"venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.702982Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:0f8eda009ae2b31c001d219ca73801ff3517e12c81673cb70b3067ae60d29780","observation_id":"28a55d12-84f1-42a4-a04f-6251fa34c5d1","resolution":{"observed_at":"2026-08-15T19:47:59.702982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19039","last_updated":"2024-07-26T18:45:09Z","snapshot_observed_at":"2026-08-17T09:49:10.517040Z","submitted_at":"2024-07-26T18:45:09Z","title":"GraphBPE: Molecular Graphs Meet Byte-Pair Encoding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19039","snapshot_observed_at":"2026-08-15T19:47:59.708390Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.708390Z"},"links":{"cited_paper":"/paper/2407.19039","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:ad692e2c36dd7ec2e3eb7dc20560ef0ce6947e6de592cea6f14c1cc4118a922f","observation_id":"a06282b0-b9af-4278-8eae-5bbe90737881","resolution":{"observed_at":"2026-08-15T19:47:59.708390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-15T19:47:59.713821Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.713821Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:9e2abde99996c6a7a56fe1804a575607b6ead807a67d279d3556315f9be7235a","observation_id":"ede9fb37-7323-40da-ad93-437a2ae4f719","resolution":{"observed_at":"2026-08-15T19:47:59.713821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:48:00.571174Z","title":null,"venue":null,"work_id":"29f86595-7b53-482e-bb5e-a603e40d108b","year":2025},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.719506Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:21f0decd4e90fc41e015bc5a9535d763b96f34d1d8f6cb605d535e97da6b71ae","observation_id":"2c2ff89f-1880-4dc8-9817-8bdced36407b","resolution":{"observed_at":"2026-08-15T19:48:00.576646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.724409Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.724409Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:bd813c6ff1d65b05a6f6dbbaa1edfa6b291159cc81e4e6351ef469f4d9770311","observation_id":"b7e52288-1eb2-47fa-8dd0-165a107a50c5","resolution":{"observed_at":"2026-08-15T19:47:59.724409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:48:00.537112Z","title":null,"venue":null,"work_id":"66ea8afc-4149-4e26-ade2-b7b8ffa4da84","year":2021},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.729082Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:82876b83b0318023f71b535130f19f1cb31df525806f18c964ecc401fe59a3a1","observation_id":"c729b015-b5da-4362-854c-f21b28201505","resolution":{"observed_at":"2026-08-15T19:48:00.542767Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.734578Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.734578Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:17185a757adb40ed3f3cea1a3241a7339867afe87d35adba925ee4eac3398fd5","observation_id":"ca33ab7b-9023-43de-9866-0836d7d2750a","resolution":{"observed_at":"2026-08-15T19:47:59.734578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07095","last_updated":"2023-02-10T12:48:37Z","snapshot_observed_at":"2026-08-16T16:24:27.037361Z","submitted_at":"2022-10-13T15:22:59Z","title":"Incorporating Context into Subword Vocabularies","version":2},"cited_work":{"arxiv_id":"2210.07095","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.07095","snapshot_observed_at":"2026-08-15T19:47:59.822462Z","title":"Incorporating Context into Subword Vocabularies","venue":"cs.CL","work_id":"dee47980-401b-4a12-9971-4d6ba3b164bf","year":2022},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.739214Z"},"links":{"cited_paper":"/paper/2210.07095","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:50a44fff78337d1ff00a1663a0d28e0a61d18f5854cb26387e4ad79b68c2fc42","observation_id":"62662ad5-5887-4af7-b6a9-c466c1c5c735","resolution":{"observed_at":"2026-08-15T19:47:59.830216Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.07830","last_updated":"2019-05-19T23:57:23Z","snapshot_observed_at":"2026-08-15T09:37:44.321271Z","submitted_at":"2019-05-19T23:57:23Z","title":"HellaSwag: Can a Machine Really Finish Your Sentence?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.07830","snapshot_observed_at":"2026-08-15T19:47:59.744094Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.744094Z"},"links":{"cited_paper":"/paper/1905.07830","citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:640c14792b257385b1f7ac785b875ede287601ba1f3b2dca185d5fa0eab7ed35","observation_id":"61c4df7f-8b48-41f6-8eb7-1eee03035ef1","resolution":{"observed_at":"2026-08-15T19:47:59.744094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:48:00.500663Z","title":null,"venue":null,"work_id":"530dc1a3-205a-44c0-8f70-d5046df7caf3","year":2023},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.749059Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:c627c0d0ae2d4094d47fb3056e83ef896a0a7b0ae658c17c15a1b3f8da41b376","observation_id":"97e3abbc-fa98-4126-a164-b72201ff0742","resolution":{"observed_at":"2026-08-15T19:48:00.508061Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.753544Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.753544Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:5f5345d37b42dd6692365879c845e67d7bfd100f057ac0ae1894594765558fef","observation_id":"4c745d4c-f867-4088-8ba9-09f34a09e274","resolution":{"observed_at":"2026-08-15T19:47:59.753544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T19:47:59.758998Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T19:47:59.758998Z"},"links":{"citing_paper":"/paper/2506.15138"},"observation_digest":"sha256:7a797e50c37f4d877f7edb1243ddffbe3b567a3271d03bc0a6d5c437802fc1d5","observation_id":"a331d249-8366-463f-a9a3-1fa6767d7d33","resolution":{"observed_at":"2026-08-15T19:47:59.758998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.15138","last_updated":"2025-06-18T04:40:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T21:46:08.758667Z","submitted_at":"2025-06-18T04:40:44Z","title":"Thunder-Tok: Minimizing Tokens per Word in Tokenizing Korean Texts for Generative Language Models"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 0 inbound Pith citation observations for arXiv:2506.15138."}