{"as_of":"2026-08-14T08:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:23ee2c080ec4d33cd1fa0f86fd5e2f6a736b9ef0de229104b7ce17ad511a0554","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:26:33.693932Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T23:21:22.456506Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T08:53:03.779632Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10641","snapshot_observed_at":"2026-08-05T23:21:22.456506Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05468","last_updated":"2025-08-07T15:11:17Z","snapshot_observed_at":"2026-08-09T14:27:14.474056Z","submitted_at":"2025-08-07T15:11:17Z","title":"TASE: Token Awareness and Structured Evaluation for Multilingual Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T23:21:22.456506Z"},"links":{"cited_paper":"/paper/2506.10641","citing_paper":"/paper/2508.05468"},"observation_digest":"sha256:334a1688d59d6fe43106e562cfd31cbc2bef41bbe8fe1a50c2a149c77093a043","observation_id":"61f8c5a0-e402-42a5-85d0-f980a2004457","resolution":{"observed_at":"2026-08-05T23:21:22.456506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"cited_work":{"arxiv_id":"2506.10641","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.10641","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"and Inui, K","venue":null,"work_id":"8f884c07-2ea0-4fa5-9a34-176d9577e6b3","year":null},"citing_paper":{"arxiv_id":"2604.16037","last_updated":"2026-04-17T13:05:46Z","snapshot_observed_at":"2026-08-13T14:25:00.460900Z","submitted_at":"2026-04-17T13:05:46Z","title":"Stochasticity in Tokenisation Improves Robustness","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T08:49:55.126650Z"},"links":{"cited_paper":"/paper/2506.10641","citing_paper":"/paper/2604.16037"},"observation_digest":"sha256:79eaadcf7c6ec503155db98a5e7a6914ead1e123d636f532e5d41e7c013a65bf","observation_id":"54aa63ef-c5d2-4158-a03c-314999feb6f7","resolution":{"observed_at":"2026-05-10T08:53:03.781857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.10641/citation-record","integrity":"/paper/2506.10641/integrity","json":"/paper/2506.10641/citation-record.json","paper":"/paper/2506.10641"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.243767Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.243767Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:0371d9fbb590604586984162116764d327e606673bb7623ca34ac1b4eddd1ec1","observation_id":"378e16fa-98f8-4289-8074-df10ae9ef921","resolution":{"observed_at":"2026-08-07T04:26:31.243767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.314409Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.314409Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:0a229dacbfa39eaf7e451d427edaa53852a456fe0c0feab7b9d04f0707b0293e","observation_id":"aceadba6-d52d-41fa-86ab-662cc6afb66a","resolution":{"observed_at":"2026-08-07T04:26:31.314409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.15471","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.957437Z","title":null,"venue":null,"work_id":"ee444eb7-59b5-417e-9d1f-0de8b0039bd9","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.411745Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:9302bd8cd03e9029d002fbb07fb15d0382f295fc67d503599fec81e017ac7d1d","observation_id":"0acb7c1c-28fb-4990-8a0c-90fd564c8b98","resolution":{"observed_at":"2026-08-07T04:26:33.961310Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.520808Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.520808Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:7b5a4c481220bb7e8352081f1259a4c135b055aba48efa59bc5c191f7807904f","observation_id":"29c031c0-611e-4b8f-899c-b91956ce386f","resolution":{"observed_at":"2026-08-07T04:26:31.520808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T04:26:31.653612Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.653612Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:4a35143d89792f8ce7b661ed1ddf61115ec55fa8ef3b293fcc25d60380edf48a","observation_id":"01fb045f-3589-4afc-9cc6-d9e8a92eadcd","resolution":{"observed_at":"2026-08-07T04:26:31.653612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.683263Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.683263Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:c28ae9a755d85ce34b9df80cfadda476e561314b3786a8106eafd09d9f78d650","observation_id":"f578a522-3f15-45a8-a12f-f9b2d2c7c182","resolution":{"observed_at":"2026-08-07T04:26:31.683263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18626","last_updated":"2024-12-19T22:47:08Z","snapshot_observed_at":"2026-08-11T11:23:54.929674Z","submitted_at":"2024-12-19T22:47:08Z","title":"Why Do Large Language Models (LLMs) Struggle to Count Letters?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18626","snapshot_observed_at":"2026-08-07T04:26:31.714015Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.714015Z"},"links":{"cited_paper":"/paper/2412.18626","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:b46409bdb3cb3ae823ba80de1a319ed999a173e7012a61ce6d7d84d6fd971a44","observation_id":"8253a5a2-d16a-417e-9068-178de9b74344","resolution":{"observed_at":"2026-08-07T04:26:31.714015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:31.839142Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.839142Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:ccdea0c3369b5265c3ca84c5cdf9ae87c62d108c014ae0212187af666782bb1e","observation_id":"c11e9a75-7d09-4561-84f5-9f41c715724a","resolution":{"observed_at":"2026-08-07T04:26:31.839142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09808","last_updated":"2024-02-22T15:11:57Z","snapshot_observed_at":"2026-08-13T04:18:30.751463Z","submitted_at":"2024-02-15T09:14:53Z","title":"Knowledge of Pretrained Language Models on Surface Information of Tokens","version":2},"cited_work":{"arxiv_id":"2402.09808","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.09808","snapshot_observed_at":"2026-08-07T04:26:33.849540Z","title":"Knowledge of Pretrained Language Models on Surface Information of Tokens","venue":"cs.CL","work_id":"757316aa-0a7b-4e64-8c20-e87016fb30e9","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:31.930401Z"},"links":{"cited_paper":"/paper/2402.09808","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:2dd14855b4a1dea84f783112189e1f0df3bbc5d6ca0614a4d23d7f6232f16d32","observation_id":"fbeb45f7-a95b-48b1-88fa-6a2a46efd9f2","resolution":{"observed_at":"2026-08-07T04:26:33.852554Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:32.087450Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.087450Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:457e835a7830332fb198d3891dff2242a3d5e843314c51113a7ec3af9a667dc6","observation_id":"347fe4f6-bd3e-46fd-902c-fbed2d6bef78","resolution":{"observed_at":"2026-08-07T04:26:32.087450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:34.040093Z","title":null,"venue":null,"work_id":"fb389051-331c-4d89-b8b2-3eda4ecea7bd","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.247345Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:2e097b491cb7d439fc1ad5079e3f2352298971fab6affe11c5b220189feaf108","observation_id":"878244f6-addd-4c31-b4cc-8660c49ce0b7","resolution":{"observed_at":"2026-08-07T04:26:34.043258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:32.343817Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.343817Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:4c4c0b0108367f7e6f0448570cee551c36ecde53f3a6fd4c12b392e0b26f7bcc","observation_id":"c460caa5-2dc9-4cbd-9227-cb486d2ae284","resolution":{"observed_at":"2026-08-07T04:26:32.343817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T04:26:32.448062Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.448062Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:167b4e6cc0979fbbf0acd4f6d429693d8327bbf9f27987e67e98a3911c25a5df","observation_id":"eb92fc9c-cbd5-4a1d-8c42-3030878544e4","resolution":{"observed_at":"2026-08-07T04:26:32.448062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:32.558945Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.558945Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:5e508608830b926b8731aaa2edc3d8e50989b57247682662df79b21a1ed3267b","observation_id":"4b409dc4-cda9-495a-8400-4b1e3cab9f96","resolution":{"observed_at":"2026-08-07T04:26:32.558945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:34.026155Z","title":null,"venue":null,"work_id":"0e437477-51d2-49de-9159-46fa1559711e","year":2022},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.672657Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:ad67c587ab267584b458ab8ae15dec4bdbbb9feef910299ce7ed72ef61100391","observation_id":"f374de54-8bd9-4dcb-862a-c31513a37023","resolution":{"observed_at":"2026-08-07T04:26:34.029154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:34.018051Z","title":"Llm360: Towards fully transparent open-source llms","venue":null,"work_id":"e3190026-e5c5-4a8f-a9e3-b9b890cb2e58","year":null},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.773231Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:33b277aa363e67f052d7d310bd7bcb6e51edb910e561bb536996473313564430","observation_id":"7c6f9c18-abf7-44be-a22a-fdb001ea8e3e","resolution":{"observed_at":"2026-08-07T04:26:34.020786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.672","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"e1ba9f34-3d54-4cf5-a6a4-104d0ac534b4","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:32.884147Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:b09b1ec4f726e0fe3e69ab381eac570891a7036c7d6f3ce369255d58dac4aee0","observation_id":"1ebd722a-c43f-484b-a6c2-15f08eefd5e5","resolution":{"observed_at":"2026-08-07T04:26:33.734185Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:34.008821Z","title":"What does the knowledge neuron thesis have to do with knowledge? In The Twelfth International Conference on Learning Representations","venue":null,"work_id":"e229ad48-2d18-4fdf-8765-de9656d4ef04","year":null},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.002329Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:77bddbecdfa7ee4fea7f91ffe9e1735986e7efd25543f7fb56129a83a8180852","observation_id":"eac13e7a-8373-4bfe-9f11-50aac408741e","resolution":{"observed_at":"2026-08-07T04:26:34.012114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.999550Z","title":null,"venue":null,"work_id":"a1825ff5-6c97-45c8-ac3d-7f272e4c6f77","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.119949Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:df7fde3e4f2842fb6c9258f3a1a0025b16b851b0271b6a9cd143da00c967583b","observation_id":"6fcd29f1-3b56-4fd0-9a4d-90e3fc47d2f7","resolution":{"observed_at":"2026-08-07T04:26:34.002339Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T04:26:33.249209Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.249209Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:fd0dfa545a8bbdf18febe04a26ea0162f88171a787c245aaf5768abf47d2c87a","observation_id":"0f89f17c-d92b-409d-905a-e34a743ebed5","resolution":{"observed_at":"2026-08-07T04:26:33.249209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19669","last_updated":"2025-02-27T01:30:07Z","snapshot_observed_at":"2026-08-07T17:44:31.347763Z","submitted_at":"2025-02-27T01:30:07Z","title":"Investigating Neurons and Heads in Transformer-based LLMs for Typographical Errors","version":1},"cited_work":{"arxiv_id":"2502.19669","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.19669","snapshot_observed_at":"2026-08-07T04:26:33.821395Z","title":"Investigating Neurons and Heads in Transformer-based LLMs for Typographical Errors","venue":"cs.CL","work_id":"5f680383-020c-4d94-927a-4a19fd441f6e","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.371720Z"},"links":{"cited_paper":"/paper/2502.19669","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:08689e20e74b00ca8cab39a4ff31cb9d1d79acd1e1aa2cc263a3f2ea36e03776","observation_id":"8b383fd9-a079-4158-836d-ecdf48d31005","resolution":{"observed_at":"2026-08-07T04:26:33.824675Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.489770Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.489770Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:1fd5e8d2ca6a960e5a430fe493b62add16dd5c7b920c9977d4a168fd476000a0","observation_id":"4b69dc70-7368-4cb1-9ce6-16d5555dd419","resolution":{"observed_at":"2026-08-07T04:26:33.489770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.602050Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.602050Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:19238faaf26b63500bace25f07665f5a17bd091d7f1ca7f1568609fd6f398dea","observation_id":"21fcc33b-fb1d-4986-a61e-975678a512e6","resolution":{"observed_at":"2026-08-07T04:26:33.602050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01714","last_updated":"2025-03-03T16:31:45Z","snapshot_observed_at":"2026-08-07T17:33:08.982744Z","submitted_at":"2025-03-03T16:31:45Z","title":"Word Form Matters: LLMs' Semantic Reconstruction under Typoglycemia","version":1},"cited_work":{"arxiv_id":"2503.01714","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01714","snapshot_observed_at":"2026-08-07T04:26:33.809899Z","title":"Word Form Matters: LLMs' Semantic Reconstruction under Typoglycemia","venue":"cs.CL","work_id":"c8ec5028-7d01-4916-8d52-a9909529fede","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.662516Z"},"links":{"cited_paper":"/paper/2503.01714","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:afc81cbb271e2ad27caa2e2dae30603f7ad91bb6a79dff26f8e78425b11471ac","observation_id":"62853d5d-6eaa-49cb-bedb-c9133444f316","resolution":{"observed_at":"2026-08-07T04:26:33.813364Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.986287Z","title":null,"venue":null,"work_id":"72e5c267-7ba0-4e21-908c-5942810921fe","year":2022},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.665939Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:aac7e8e53b6045273fc87469cd4205155aa7eb0b1a58c4e5c9ec139abe0b508c","observation_id":"0cf52350-a311-40e0-8ae5-8747f4c65c27","resolution":{"observed_at":"2026-08-07T04:26:33.989190Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01208","last_updated":"2025-01-26T03:20:09Z","snapshot_observed_at":"2026-08-12T22:32:55.153840Z","submitted_at":"2024-10-02T03:23:29Z","title":"StringLLM: Understanding the String Processing Capability of Large Language Models","version":3},"cited_work":{"arxiv_id":"2410.01208","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.01208","snapshot_observed_at":"2026-08-07T04:26:33.798726Z","title":"StringLLM: Understanding the String Processing Capability of Large Language Models","venue":"cs.CL","work_id":"f8685895-1658-424b-b1d8-532348ea99d6","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.669016Z"},"links":{"cited_paper":"/paper/2410.01208","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:2cfc5ff09e0537d71160b9876cd361ef62387e40f1335f66d69a989eb629bc4d","observation_id":"d0a9cbee-b8cf-4679-bcac-62548393b515","resolution":{"observed_at":"2026-08-07T04:26:33.801808Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.672546Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.672546Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:65ef69ce6cbc15a2ca43fab8a2f581eae0f7b82206be4732025cf88a41f6db6e","observation_id":"4a134eb2-2a02-4543-bac6-8797cba30682","resolution":{"observed_at":"2026-08-07T04:26:33.672546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.978103Z","title":null,"venue":null,"work_id":"935b93b9-6995-42b2-a839-fb187901f59e","year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.675707Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:94f1e4adb13e8883eda627d97dcaf5ae8f61d4f5015369c29523111c78051a6a","observation_id":"858fba64-5c06-4790-84cd-8fdc1f354e61","resolution":{"observed_at":"2026-08-07T04:26:33.981043Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.08180","last_updated":"2025-03-27T16:07:18Z","snapshot_observed_at":"2026-08-12T04:16:25.054962Z","submitted_at":"2025-02-12T07:37:39Z","title":"Enhancing LLM Character-Level Manipulation via Divide and Conquer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.08180","snapshot_observed_at":"2026-08-07T04:26:33.682038Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.682038Z"},"links":{"cited_paper":"/paper/2502.08180","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:405dac4d6aad035b98df2e40af2e2f4c0a3a77fd1c10a5fee042e0c765ba6c1d","observation_id":"1c402b66-f3fe-41f8-8b49-955472013c6c","resolution":{"observed_at":"2026-08-07T04:26:33.682038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.17679","last_updated":"2025-06-09T07:15:53Z","snapshot_observed_at":"2026-08-14T05:07:41.625726Z","submitted_at":"2024-11-26T18:44:39Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","version":5},"cited_work":{"arxiv_id":"2411.17679","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.17679","snapshot_observed_at":"2026-08-07T04:26:33.777023Z","title":"Enhancing Character-Level Understanding in LLMs through Token Internal Structure Learning","venue":"cs.CL","work_id":"dcd97031-f396-4ebe-8145-669b7c2f9a24","year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.685177Z"},"links":{"cited_paper":"/paper/2411.17679","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:4be55da73d4cfba0020e9f66fbf4125e9f429b43c4179148dc625cfb59b01814","observation_id":"f6992535-03a2-49c8-9810-0ba54a03cabd","resolution":{"observed_at":"2026-08-07T04:26:33.781426Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T04:26:33.687905Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.687905Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:43e28a1b93f1c89e568a62707655157005e04565db66496a8ce279bceb72243b","observation_id":"fbb06023-a275-4336-9df3-0a0552725461","resolution":{"observed_at":"2026-08-07T04:26:33.687905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.690583Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.690583Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:ca5e7e639631b1c35a984391b2cc89b93d8beb8524237885a8a0e11aab01eaa9","observation_id":"f99b131c-5637-4e94-83c5-834ef548c64d","resolution":{"observed_at":"2026-08-07T04:26:33.690583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:26:33.693932Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T04:26:33.693932Z"},"links":{"citing_paper":"/paper/2506.10641"},"observation_digest":"sha256:1d23e55853efe767bff2de8bc051e2d9eaa4c77048fee8a5936100e65ea6f485","observation_id":"554d7b9b-828f-470c-b293-d0c9fbeb0677","resolution":{"observed_at":"2026-08-07T04:26:33.693932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.10641","last_updated":"2025-06-12T12:27:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T10:25:07.728603Z","submitted_at":"2025-06-12T12:27:41Z","title":"Spelling-out is not Straightforward: LLMs' Capability of Tokenization from Token to Characters"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":7,"verified_fuzzy":2},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 2 inbound Pith citation observations for arXiv:2506.10641."}