{"as_of":"2026-08-22T19:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:417f33af89aa49ea43034faedf43fab9f73abedae486d117864ac30736e9b1fa","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:20:55.975121Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T18:51:20.043728Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T23:50:52.393677Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"cited_work":{"arxiv_id":"2506.18639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.18639","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yifan Hu, Frank Liang, Dachuan Zhao, Jonathan Geuter, Varshini Reddy , Craig W","venue":null,"work_id":"41031dac-61f4-470d-b997-b60cccb85271","year":null},"citing_paper":{"arxiv_id":"2604.05192","last_updated":"2026-08-11T13:37:49Z","snapshot_observed_at":"2026-08-15T00:23:03.056268Z","submitted_at":"2026-04-06T21:43:48Z","title":"Faster Superword Tokenization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T18:51:20.043728Z"},"links":{"cited_paper":"/paper/2506.18639","citing_paper":"/paper/2604.05192"},"observation_digest":"sha256:66fe3a293b534cf8e684fd68cfb8ebfe2f7e542e2e6b894a5200f941d4aad158","observation_id":"e052c859-f830-44e6-bc1e-352cbf49d08f","resolution":{"observed_at":"2026-05-10T23:50:52.401239Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.18639/citation-record","integrity":"/paper/2506.18639/integrity","json":"/paper/2506.18639/citation-record.json","paper":"/paper/2506.18639"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:02.040723Z","title":"Exploring BERT 's vocabulary, 2019","venue":null,"work_id":"5b65d721-afa6-449c-92e8-c1d649f771cc","year":2019},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:50.442180Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:2e2655120a15198fbceb792d15d60abc77b72414823059a8c1667d0d77349ff1","observation_id":"d4d40306-5aec-418c-ab51-bff99eda52d8","resolution":{"observed_at":"2026-08-06T23:21:02.168345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:50.556987Z","title":"M orphy N et: A large multilingual database of derivational and inflectional morphology","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:50.556987Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:94ae2f9fa5968a64e85bc25cc09e9e40160807ed7e9062e6d1b796bba901da1a","observation_id":"6c86e1f8-1343-4a5a-af59-320ebde1cb24","resolution":{"observed_at":"2026-08-06T23:20:50.556987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:01.874336Z","title":"G., Ryskina, M., Mielke, S., Budianskaya, E., El-Khaissi, C., Pimentel, T., Gasser, M., Lane, W","venue":null,"work_id":"71e25f23-559f-42c7-802a-a3741bc98d0c","year":2022},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:50.638339Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:c497bec37e57ba33ea611516fdc780645836dcc42d00341ae4def4e8752ee8b6","observation_id":"380b1639-fa6c-4f48-afa2-8a78d5b07630","resolution":{"observed_at":"2026-08-06T23:21:01.965685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:50.744745Z","title":"and Pinter, Y","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:50.744745Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:1046c31fdcf3f35ba0f6229d6900fcb12b0b8cbbb6f065f63273eb65b46e7d82","observation_id":"4c6a3187-d0f0-4a5b-b1f5-0a62df382130","resolution":{"observed_at":"2026-08-06T23:20:50.744745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1023/a:1007541817488","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Machine Learning","work_id":"c357a46b-49ce-4540-9cbf-54b77808c175","year":1999},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:50.862337Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:958ed4c8f867a2e795c84cd0a2fe3e2c7dc72dbba365552758adb6d298d371c6","observation_id":"758c2f7e-421c-4bec-beb0-d1ae8b15481e","resolution":{"observed_at":"2026-08-06T23:20:58.769635Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:50.963708Z","title":"Tokenization falling short: O n subword robustness in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:50.963708Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:c06126772a2c06577f079513993494335a842cf2d80595476114142ea0bb57d4","observation_id":"a5361ed9-6ea8-4f08-b82f-a2852ec00772","resolution":{"observed_at":"2026-08-06T23:20:50.963708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1080/016909698386528","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"H., Allen, J., and Seidenberg, M","venue":"Language and Cognitive Processes","work_id":"c1f206a0-5e4a-46e7-a96d-aab4bb9c926c","year":1998},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:51.076387Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:0473d4d4ba0716ea2975810f209e6f37532b29fba27ef407d6520d35cb9f5094","observation_id":"4c3f15e9-b75e-48ed-a665-dad23eda1738","resolution":{"observed_at":"2026-08-06T23:20:58.484580Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3115/v1/w14-0505","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"and Nerbonne, J","venue":null,"work_id":"cfca7993-247e-4886-9507-8dfd454f467d","year":2014},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:51.207819Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:ab01b8233703df6b0a904ddd3b534e366b1bf41419a60bbb2fa141b4d58a4d66","observation_id":"5633407a-36bc-4006-ae3b-a878eb782921","resolution":{"observed_at":"2026-08-06T23:20:58.287179Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:01.803231Z","title":null,"venue":null,"work_id":"d4781423-1b79-4935-b554-7d2c451c2628","year":2020},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:51.354750Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:228c356c41ca6375370671dd42c7797baf59db7b6accc26e04f3b341155bad5e","observation_id":"aad3ec9f-21b2-47a6-95e0-7cb917a9f041","resolution":{"observed_at":"2026-08-06T23:21:01.834731Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:51.461949Z","title":null,"venue":null,"work_id":null,"year":1990},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:51.461949Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:48e0cbed3bfa825fd6f1efb20634386e63d0ae58f809275960188ef50b42a8eb","observation_id":"4f404ffd-daba-4488-8d9d-139799d036b8","resolution":{"observed_at":"2026-08-06T23:20:51.461949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3758/s13428-019-01282-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"L., Spalding, T","venue":"Behavior Research Methods","work_id":"dcf459c8-002a-4419-b6ca-7bd377f16890","year":2019},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:51.607394Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:0096d82d80b852a5b62634e39618a2cb822bd4f5734f69a3f63514cde4cbc49e","observation_id":"e30d1526-9b72-4cea-ac11-7aa39412eb75","resolution":{"observed_at":"2026-08-06T23:20:58.164614Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14433","last_updated":"2025-06-02T19:43:46Z","snapshot_observed_at":"2026-08-19T03:09:50.776395Z","submitted_at":"2025-03-18T17:11:09Z","title":"Splintering Nonconcatenative Languages for Better Tokenization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14433","snapshot_observed_at":"2026-08-06T23:20:51.698108Z","title":"Splintering nonconcatenative languages for better tokenization, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:51.698108Z"},"links":{"cited_paper":"/paper/2503.14433","citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:1052ec98d3b26d7b769fc249be91f75dc2c20ef151580eb2d46502cfc7ba6b46","observation_id":"6c07660e-a183-44c0-af41-032c6850d8ab","resolution":{"observed_at":"2026-08-06T23:20:51.698108Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03338","last_updated":"2025-06-12T11:11:51Z","snapshot_observed_at":"2026-08-16T12:43:59.616010Z","submitted_at":"2025-04-04T10:42:56Z","title":"BabyLM's First Words: Word Segmentation as a Phonological Probing Task","version":3},"cited_work":{"arxiv_id":"2504.03338","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.03338","snapshot_observed_at":"2026-08-06T23:20:59.650050Z","title":"BabyLM's First Words: Word Segmentation as a Phonological Probing Task","venue":"cs.CL","work_id":"6d5c2407-5d6f-4809-8798-f46c2d2a449c","year":2025},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:51.792301Z"},"links":{"cited_paper":"/paper/2504.03338","citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:6e6664c2e7980e66c41cee1dd0d4a8d8755aa05804246e32056e4aeacab61267","observation_id":"454aac8c-3729-42af-9ace-be3836f8b710","resolution":{"observed_at":"2026-08-06T23:20:59.824686Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1017/s0305000923000491","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Word segmentation from transcriptions of child-directed speech using lexical and sub-lexical cues","venue":"Journal of Child Language","work_id":"3a572f50-2bfa-4708-8206-b922345cf290","year":2025},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:51.946038Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:b92433d4b74fdf2b344d56d8ac968689cc90826ba8cb838156bf7576e8e243be","observation_id":"e1f5b2fd-2311-41e4-9ae4-a3fc189880d2","resolution":{"observed_at":"2026-08-06T23:20:57.906313Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.emnlp-main.786","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Improving tokenisation by alternative treatment of spaces","venue":null,"work_id":"f82e5312-f37b-42e1-bffc-14f6493684fb","year":2022},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:52.070279Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:797c697c60837922fc53a26f58296c9bb0a90ea0edb4b0206367e23ff688dc0a","observation_id":"977606a9-505c-4387-9fb5-50cbc965660e","resolution":{"observed_at":"2026-08-06T23:20:57.699146Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:01.650621Z","title":null,"venue":null,"work_id":"4265c69e-57dc-4757-9df6-3c6f9790c9b7","year":1955},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:52.206545Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:bbeb09bf88bbdec9cc3daf370f92ce7ea06690ecaf2acdf5cba1bbbbf0d4b3b6","observation_id":"6dd0e1c2-24e9-4ef9-ba8a-1e936be536b7","resolution":{"observed_at":"2026-08-06T23:21:01.711333Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.emnlp-main.316","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"D ago BERT : G enerating derivational morphology with a pretrained language model","venue":null,"work_id":"74c4fabf-3b67-4263-a4bb-dc9c48286345","year":2020},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:52.250811Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:d95b6d93fbe8c488bf7583b14dab3589a9344bec79a0cbc78f4772ceadd8ec5c","observation_id":"674695cd-b193-42fd-9170-fc5cb1c89a70","resolution":{"observed_at":"2026-08-06T23:20:57.464412Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06395","last_updated":"2024-06-03T08:54:38Z","snapshot_observed_at":"2026-08-12T13:10:06.472493Z","submitted_at":"2024-04-09T15:36:50Z","title":"MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06395","snapshot_observed_at":"2026-08-06T23:20:52.416447Z","title":"Mini CPM : U nveiling the potential of small language models with scalable training strategies","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:52.416447Z"},"links":{"cited_paper":"/paper/2404.06395","citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:99b1047897334e810fd5a7ae3e47f46678ca8e2a1e51becc60f3bea74e00ec3b","observation_id":"38f0f2f5-295f-44f1-ae76-e6c1d5d14ffe","resolution":{"observed_at":"2026-08-06T23:20:52.416447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01561","last_updated":"2022-08-02T16:07:31Z","snapshot_observed_at":"2026-08-16T16:41:40.224958Z","submitted_at":"2022-08-02T16:07:31Z","title":"Lost in Space Marking","version":1},"cited_work":{"arxiv_id":"2208.01561","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.01561","snapshot_observed_at":"2026-08-06T23:20:59.431532Z","title":"Lost in Space Marking","venue":"cs.CL","work_id":"d5912177-d0b6-4174-8498-acbb2ce6f0a6","year":2022},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:52.734753Z"},"links":{"cited_paper":"/paper/2208.01561","citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:360288364558e70e9b897dc3bd06bd4d617fd169cdbff859a019f3f893c4b262","observation_id":"47c4f376-ae3f-42dd-9a9d-93a8e2b05b71","resolution":{"observed_at":"2026-08-06T23:20:59.507164Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08442","last_updated":"2023-04-17T17:03:56Z","snapshot_observed_at":"2026-08-16T15:39:49.500140Z","submitted_at":"2023-04-17T17:03:56Z","title":"The MiniPile Challenge for Data-Efficient Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08442","snapshot_observed_at":"2026-08-06T23:20:52.816970Z","title":"The M ini P ile challenge for data-efficient language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:52.816970Z"},"links":{"cited_paper":"/paper/2304.08442","citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:67ba639aaab541e128c91ace831b32eb4e74a42471bfe9eab451f005a623f441","observation_id":"a69bde22-87cd-4b7b-9563-486cfafb349e","resolution":{"observed_at":"2026-08-06T23:20:52.816970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-06T23:20:52.930480Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:52.930480Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:02985e12351299660ac4ee1e50d682287b231e0874aac46d29e21a959c263394","observation_id":"62f486a7-81f2-47f8-8355-66410540322d","resolution":{"observed_at":"2026-08-06T23:20:52.930480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:53.064748Z","title":"Subword regularization: Improving neural network translation models with multiple subword candidates","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:53.064748Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:e40e78343317374678c27bd5c94b2bf70e354ebc9a2cc3188926ec54e908dfc4","observation_id":"72692b47-a437-4084-a287-a007c5468f80","resolution":{"observed_at":"2026-08-06T23:20:53.064748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:01.455232Z","title":"The Common Corpus : A new massively multilingual dataset, September 2021","venue":null,"work_id":"e9700c65-2cf1-421f-9482-379e5a936c9c","year":2021},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:53.164513Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:be34b44672b9d567140dc35664f4cb5015c33df7c0399b2def71ade6344adf47","observation_id":"05069aec-755d-42cf-a5ed-91632af5d35c","resolution":{"observed_at":"2026-08-06T23:21:01.539385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:53.256141Z","title":"MYTE : Morphology-driven byte encoding for better and fairer multilingual language modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:53.256141Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:3574b5ec6d269ee0682c585977057a5a26cb20d60283f52808e0bf354d23855e","observation_id":"9dca9e2d-266d-4176-8dd2-ce7959edc41f","resolution":{"observed_at":"2026-08-06T23:20:53.256141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:53.547939Z","title":"and Hutter, F","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:53.547939Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:236ddb99823c8e46b1561892eb112141387a0bb745549e6cfcf8ab43366bc2de","observation_id":"cc8af55c-86a4-412a-a5df-ed4b876d63ab","resolution":{"observed_at":"2026-08-06T23:20:53.547939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:01.265743Z","title":"The acquisition of morphophonology","venue":null,"work_id":"ffe8fed4-d69d-4491-856b-40aae5419c39","year":1978},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:53.677304Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:005c46a4e94a3e45b017069841ab48262eaa145eb55bb8f7fdc7d4a5d7fda89d","observation_id":"cfb40576-7d5f-46b7-ad52-a5a4810feb2f","resolution":{"observed_at":"2026-08-06T23:21:01.328853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.24","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"C ompound P iece: E valuating and improving decompounding performance of language models","venue":null,"work_id":"fdc258a3-5ac7-40ee-85f5-1ca47015f396","year":2023},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:53.807352Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:25e73bd3d139f50792b7cc5e8cff27c3d970115b50855248ccb88ca0ba1e6228","observation_id":"3c5e7032-7d29-4007-b448-627ea77750d0","resolution":{"observed_at":"2026-08-06T23:20:57.155446Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:53.869265Z","title":"Hierarchical transformers are more efficient language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:53.869265Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:7cae09c6d12eff67110481276533e06ba8ad7eca2530b1df25bc498cbc734bef","observation_id":"b6ae425c-8731-4335-ad2f-240166d6bc27","resolution":{"observed_at":"2026-08-06T23:20:53.869265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:53.974889Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:53.974889Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:5a57a377e46e4153abea92d9dca4b33567430b4ea85000628f5c0cdd640634ef","observation_id":"f27b28ee-812e-48ab-9b93-432a11278d35","resolution":{"observed_at":"2026-08-06T23:20:53.974889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09871","last_updated":"2024-12-13T05:33:32Z","snapshot_observed_at":"2026-08-15T13:45:11.226724Z","submitted_at":"2024-12-13T05:33:32Z","title":"Byte Latent Transformer: Patches Scale Better Than Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09871","snapshot_observed_at":"2026-08-06T23:20:54.053549Z","title":"Byte latent transformer: P atches scale better than tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:54.053549Z"},"links":{"cited_paper":"/paper/2412.09871","citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:0b9b455e95d6d04e01d40e03ebc08fdc29b81654de7dd6ef1408f8f0ea76e774","observation_id":"1db18ae7-1465-44d1-bff7-ba515ca024bd","resolution":{"observed_at":"2026-08-06T23:20:54.053549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:01.102553Z","title":"PyTorch : A n imperative style, high-performance deep learning library","venue":null,"work_id":"721b1ad3-86a8-4e5d-8d3e-cdc5b9976ff4","year":2019},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:54.204892Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:023ec1fddee364726c8451e004162718c51c6b81fc40b56b7f3485de51794490","observation_id":"56b2de42-65bd-4040-9826-5d1831615a41","resolution":{"observed_at":"2026-08-06T23:21:01.148556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:00.839261Z","title":"B., Lozhkov, A., Mitchell, M., Raffel, C., Werra, L","venue":null,"work_id":"d341cad8-3b6e-44dc-bd31-0947fb539431","year":2024},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:54.317541Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:097c8ca7ffe332efa243bc1924f36574c2d9d40b8a04ea496e968da3e6edeec2","observation_id":"a7d32713-b54b-4143-9e1c-cd664fa0d04e","resolution":{"observed_at":"2026-08-06T23:21:00.957413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:00.604719Z","title":"L., and Eisenstein, J","venue":null,"work_id":"c185504f-c4a0-4632-8cc3-2113a0562eae","year":2021},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:54.443558Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:92670d7166578d8268c3e961b1f9a139459b4d9de9ec85a15e01203dc3846bea","observation_id":"6c86c14a-e716-4e4a-801f-9554db0deee8","resolution":{"observed_at":"2026-08-06T23:21:00.694185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:54.503664Z","title":"How Good is Your Tokenizer ? On the Monolingual Performance of Multilingual Language Models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:54.503664Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:357a573f06a41d73509a49ce6e197b6a31dfb0f39095d84be266789b0047d896","observation_id":"f6e83283-7d5f-45b9-bf70-fe7b0137b2bb","resolution":{"observed_at":"2026-08-06T23:20:54.503664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:54.642466Z","title":"R., Aslin, R","venue":null,"work_id":null,"year":1926},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:54.642466Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:503af229ac75229faa56c63dd1c7e1cfca5c40b7bcdb2421b23e5190d42736e9","observation_id":"120a1001-3ed5-48bf-82ca-105e944ffd02","resolution":{"observed_at":"2026-08-06T23:20:54.642466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:54.713652Z","title":"H., Mailhot, H., Deacon, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:54.713652Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:663469056510fc8cd6b85465262c295f9a267aafc83b502480ae7467e41f48b2","observation_id":"bb3c5365-4cfc-4c81-be79-c87b95d2c145","resolution":{"observed_at":"2026-08-06T23:20:54.713652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:54.846333Z","title":"and Nakajima, K","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:54.846333Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:25fd2a900754c0d923572aec4fba08a72573de12de5b56a9f8171cc3b5d3aa62","observation_id":"6a1e7009-5686-41bf-9447-ff03782785e5","resolution":{"observed_at":"2026-08-06T23:20:54.846333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:54.928612Z","title":"Neural machine translation of rare words with subword units","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:54.928612Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:7b45b2c9a93294a90cc4c378defa45c73b673b5bcefa6de904bd724b3787c51a","observation_id":"061eefea-7d53-47a3-b687-6579133439b8","resolution":{"observed_at":"2026-08-06T23:20:54.928612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T23:20:55.045829Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.045829Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:8de76a268d531ebc0c392a8579b994daf33d9e13ea56387a7ed0660548130d28","observation_id":"1a730f6b-ca43-4041-bc71-9c932ca47eaf","resolution":{"observed_at":"2026-08-06T23:20:55.045829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:55.140561Z","title":"W., Tanner, C., and Pinter, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.140561Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:4f55e463e54bb62c11f58edb33e327ca9d49ebe45815fdce8ec7e8fae48e89ab","observation_id":"e9091c2b-9f98-4585-b6ed-750ef45bccf9","resolution":{"observed_at":"2026-08-06T23:20:55.140561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:00.458104Z","title":"N., Kaiser, L","venue":null,"work_id":"d8cf5ca5-7747-4334-8246-e45263ca5756","year":2017},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.255963Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:8ec13044f5a9eec04729e58377c067c1e9574d766a077111ba861952805ed385","observation_id":"c291be60-ca36-4737-b27f-db26345870b2","resolution":{"observed_at":"2026-08-06T23:21:00.506658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/089120101317066113","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"A statistical model for word discovery in transcribed speech","venue":"Computational Linguistics","work_id":"e6506b1d-9e0c-4a62-9ddf-a99f1578e066","year":2001},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.351249Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:da558b74e5d65f4f9669b05fe5745e3be472774d763fa4fd580d6a536ef6f4f0","observation_id":"d8e5441e-ec95-4b69-b744-9561a17e22e7","resolution":{"observed_at":"2026-08-06T23:20:56.536684Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:55.434745Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.434745Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:2b4c2fdd0867dcf8d1712f28dd6f689f20e8d31cffebf95a75d32a1b26f7e893","observation_id":"f4c2c36d-f3a4-4f46-9adf-ed9e86647da6","resolution":{"observed_at":"2026-08-06T23:20:55.434745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05192","last_updated":"2024-12-02T21:54:54Z","snapshot_observed_at":"2026-08-18T19:10:29.464364Z","submitted_at":"2024-10-07T16:49:39Z","title":"Understanding Warmup-Stable-Decay Learning Rates: A River Valley Loss Landscape Perspective","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05192","snapshot_observed_at":"2026-08-06T23:20:55.558998Z","title":"Understanding warmup-stable-decay learning rates: A river valley loss landscape perspective","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.558998Z"},"links":{"cited_paper":"/paper/2410.05192","citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:7b29ce7911d3066e25747e91e9fd87c5529324a6ed8c477a6b1cca7d258a4203","observation_id":"c175f1fc-bcb7-4348-ade2-8c41d48d21d6","resolution":{"observed_at":"2026-08-06T23:20:55.558998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:55.705673Z","title":"Transformers: S tate-of-the-art natural language processing","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.705673Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:b4a43349d48391683904548e60cee34c35a17943f00b946986c3d35c0c9a13f5","observation_id":"6e0ff8be-f08b-4386-9fb9-fd70340e2da9","resolution":{"observed_at":"2026-08-06T23:20:55.705673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:00.122890Z","title":"MEGABYTE : P redicting million-byte sequences with multiscale transformers","venue":null,"work_id":"b6817882-c6b6-4ba4-8723-1c92db609264","year":2023},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.830284Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:6bfa90da1c2427ee6b052adfcedbfc01f3efbc7f3abadf0f1138a67ad69b2d25","observation_id":"49553dfa-9798-4aeb-96c7-09c1a7a0ba04","resolution":{"observed_at":"2026-08-06T23:21:00.250613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:21:00.024658Z","title":"Scaling vision transformers","venue":null,"work_id":"804a2f0d-9b48-42da-bf0a-3e4be6c1503c","year":2022},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.905710Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:daaaa8b439643b0bca0e4f2f717d46418f79fe7c043dbc47e65257b7159f446b","observation_id":"654b7a45-51c1-45ca-9b55-cf9c015beb7d","resolution":{"observed_at":"2026-08-06T23:21:00.060704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:20:55.975121Z","title":"Tokenization and the noiseless channel","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T23:20:55.975121Z"},"links":{"citing_paper":"/paper/2506.18639"},"observation_digest":"sha256:133b99a3ee962659588473ee4a34db008b9d261ff4be7117790cdae9bc3005a8","observation_id":"e1ed16cf-d107-4930-a223-b09f2101233f","resolution":{"observed_at":"2026-08-06T23:20:55.975121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18639","last_updated":"2025-06-23T13:42:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T14:50:10.660536Z","submitted_at":"2025-06-23T13:42:00Z","title":"ByteSpan: Information-Driven Subword Tokenisation"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":11,"verified_fuzzy":10},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2506.18639."}