Pith. sign in

Paper Citation Record · LEDGER

From Language Models over Tokens to Language Models over Characters

As of 21 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 6 inbound Pith citation observations for arXiv:2412.03719.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2412.03719 v2

Coverage vector

measured 33 of 33 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-11T22:18:15.414687Z

measured 39 of 39 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-21T06:32:19.484+00:00

measured 6 of 6 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T18:29:53.362352Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-19T09:53:02.085184Z

Reference resolution

33 of 33 outbound references displayed

  • verified exact2
  • verified fuzzy8
  • unresolved23
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 6fca5c5f-1604-4f17-8a64-15a9b2b1de59 · outbound

This paper cites write newline.

From Language Models over Tokens to Language Models over Characters write newline

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.322841Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.322841Z digest=sha256:b3b30c8a8512f248c6523c13c75a11a177c6da7f95663269b7f19e055e42c6b7

Observation e02109a3-4de1-43ea-8a02-7cb4b779c669 · outbound

This paper cites Floyd, Vaughan R.

From Language Models over Tokens to Language Models over Characters Floyd, Vaughan R

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.326982Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.326982Z digest=sha256:d22a220fe8faa87df647c5c65d3cf4370bdfdd020287cc65d6a34b13df4483bf

Observation eb6ece95-7814-45fb-97ec-e7900cfd98c1 · outbound

This paper cites You should evaluate your language model on marginal likelihood over tokenisations.

From Language Models over Tokens to Language Models over Characters You should evaluate your language model on marginal likelihood over tokenisations

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.329920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.329920Z digest=sha256:ea46dea952461f1e71be9200a8d30f83693e226333b7e8b4bcc5c54eb3f9be6a

Observation 13a9c31e-eaeb-4e09-b91f-9297b865cfd3 · outbound

This paper cites Should you marginalize over possible tokenizations? In Proceedings of the Annual Meeting of the Association for Computational Linguistics, 2023.

From Language Models over Tokens to Language Models over Characters Should you marginalize over possible tokenizations? In Proceedings of the Annual Meeting of the Association for Computational Linguistics, 2023

Reference 4

Resolution
verified exact
doi, observed 2026-08-11T22:18:15.472701Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.333183Z digest=sha256:c92ecfb970b2b8b42739c119523f358cf47c838cb2048fe18874862d3b8074f7

Observation ede86109-bfc4-4a8c-904c-99d79cf3503a · outbound

This paper cites Formal Aspects of Language Modeling.

From Language Models over Tokens to Language Models over Characters Formal Aspects of Language Modeling

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.336243Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.336243Z digest=sha256:0b62dfda144c6d82c1ee4c3ae14d2a520150b8e62435d0020c24c45815861d1c

Observation 16040ac6-da22-48ab-b786-90752bf45547 · outbound

This paper cites BERT : Pre-training of deep bidirectional transformers for language understanding.

From Language Models over Tokens to Language Models over Characters BERT : Pre-training of deep bidirectional transformers for language understanding

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.339340Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.339340Z digest=sha256:121a6261d489cbb7847dc1602f735b74127b94c58a5dbc3bcab8f831fec244ef

Observation cd49539b-aa3a-40c4-860c-f196c3cccc8a · outbound

This paper cites The Llama 3 Herd of Models.

From Language Models over Tokens to Language Models over Characters The Llama 3 Herd of Models

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.343052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.343052Z digest=sha256:6876a5a2df8682a495d3e3602db7df222133279231c5d7949eb19864e0b8d535

Observation b52fcac5-c9f8-4e8d-9f13-91c3ab178c26 · outbound

This paper cites A new algorithm for data compression.

From Language Models over Tokens to Language Models over Characters A new algorithm for data compression

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.346099Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.346099Z digest=sha256:a397019ea76bf908d9b5b14add119b906b4436a8272dd23bf91067caf78baf07

Observation 40a6e600-7216-4a37-a91a-44db12175190 · outbound

This paper cites The Foundations of Tokenization: Statistical and Computational Concerns.

From Language Models over Tokens to Language Models over Characters The Foundations of Tokenization: Statistical and Computational Concerns

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.348564Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.348564Z digest=sha256:1e303667e626ec80dd5c8307fd0763e8725614e5de8b96dedca8f84cfe12f194

Observation 8fb91da1-d97f-421b-bfe1-48894ab0765a · outbound

This paper cites Grammar-constrained decoding for structured NLP tasks without finetuning.

From Language Models over Tokens to Language Models over Characters Grammar-constrained decoding for structured NLP tasks without finetuning

Reference 10

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:18:15.887700Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.352173Z digest=sha256:6002e0ed8485aaeb486714fa3246c471d27291678cc059f1b7b3cacd78f5c138

Observation 532835b6-6b64-45b0-8933-c0fdaa510a98 · outbound

This paper cites On the proper treatment of tokenization in psycholinguistics.

From Language Models over Tokens to Language Models over Characters On the proper treatment of tokenization in psycholinguistics

Reference 11

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:18:15.880059Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.354740Z digest=sha256:f61da779a9198112c4e21fdfc67c1c1a0f5a394778856a51adaa6028aac954c6

Observation 79224c68-6cfb-43b3-a464-c8c2c8715f8f · outbound

This paper cites Implementing functional languages with fast equality, sets and maps: An exercise in hash consing.

From Language Models over Tokens to Language Models over Characters Implementing functional languages with fast equality, sets and maps: An exercise in hash consing

Reference 12

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:18:15.872569Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.357519Z digest=sha256:50b68cd11d94be93aaed087043e361dba66316165dfb6fc765022c64a9b7c6ee

Observation 614a0048-2260-43f4-a84c-480a5ba4a030 · outbound

This paper cites A probabilistic E arley parser as a psycholinguistic model.

From Language Models over Tokens to Language Models over Characters A probabilistic E arley parser as a psycholinguistic model

Reference 13

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:18:15.864682Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.360220Z digest=sha256:230a0be38f7e9f08cf9261ec99aeefcc4065d651da5d3aeddc6bb126b30b1890

Observation f4e3ae24-f231-4264-bb04-87c1d38b490f · outbound

This paper cites Automata-based constraints for language model decoding.

From Language Models over Tokens to Language Models over Characters Automata-based constraints for language model decoding

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.362751Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.362751Z digest=sha256:ba90f3d9643324fdffc04c4563d83a085340e7171bdc5f84790e5ec1388f9292

Observation dc5fdc5f-ce0c-489b-9516-bb3e2d78defc · outbound

This paper cites Subword regularization: Improving neural network translation models with multiple subword candidates.

From Language Models over Tokens to Language Models over Characters Subword regularization: Improving neural network translation models with multiple subword candidates

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.365214Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.365214Z digest=sha256:f9bf4564c43c379e8cd56fe60d06d2737c5f72f179253def46f5ca13caf945a6

Observation d8e4efcc-58b9-4337-bb83-1d1b5357e0e4 · outbound

This paper cites S entence P iece: A simple and language independent subword tokenizer and detokenizer for neural text processing.

From Language Models over Tokens to Language Models over Characters S entence P iece: A simple and language independent subword tokenizer and detokenizer for neural text processing

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.367862Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.367862Z digest=sha256:fe9b6ce17a8acabe415a74fdd0c9c392228228ddb404e59b42873708cc323497

Observation 64ea0589-ae25-4320-927f-cccc670a4d3c · outbound

This paper cites Efficient Memory Management for Large Language Model Serving with PagedAttention.

From Language Models over Tokens to Language Models over Characters Efficient Memory Management for Large Language Model Serving with PagedAttention

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.370538Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.370538Z digest=sha256:3e828fc2c74a6c30bceb872c8dc6d4697c56b2cb7212ba93c661164598beb3b2

Observation 41bc8f03-3b8b-42af-9899-d18645613118 · outbound

This paper cites Expectation-based syntactic comprehension.

From Language Models over Tokens to Language Models over Characters Expectation-based syntactic comprehension

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.373407Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.373407Z digest=sha256:71199900dbda7339533f11b184ed959b94edec4cf9c5f2c694130dbf2ca474a7

Observation 2e5a7829-20a5-4eed-a283-c66fff355bd2 · outbound

This paper cites The art of prompt design: Prompt boundaries and token healing.

From Language Models over Tokens to Language Models over Characters The art of prompt design: Prompt boundaries and token healing

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.375939Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.375939Z digest=sha256:a784cf23f5925aeca1e01c7857335a784bb273985f8f71f7b0f792c5eeed8b09

Observation 82418dee-1f4c-4465-a8a6-9199d035ec98 · outbound

This paper cites Guidance.

From Language Models over Tokens to Language Models over Characters Guidance

Reference 20

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:18:15.848315Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.378584Z digest=sha256:abe25fb1eb85eef0814f8329e2278c998e163507871d062948e6dd62c77e29e3

Observation f3b821c7-86ee-405b-aef1-1d9be74b7128 · outbound

This paper cites Recurrent neural network based language model.

From Language Models over Tokens to Language Models over Characters Recurrent neural network based language model

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.381029Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.381029Z digest=sha256:58e1b39f9df7198fa37674a42f89b914529bef68180fdb6709cfce83fb666a62

Observation 66fecbe2-db4a-434a-99de-96b111677111 · outbound

This paper cites Leading Whitespaces of Language Models' Subword Vocabulary Pose a Confound for Calculating Word Probabilities.

From Language Models over Tokens to Language Models over Characters Leading Whitespaces of Language Models' Subword Vocabulary Pose a Confound for Calculating Word Probabilities

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.383587Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.383587Z digest=sha256:bdbb2b2aa72d66d4335bb2399db12657b32022115f0225ef0a904f64af3080cf

Observation 2e2e1554-dc84-41fc-8626-7bf304b77e5f · outbound

This paper cites Muckley, and Karen Ullrich.

From Language Models over Tokens to Language Models over Characters Muckley, and Karen Ullrich

Reference 23

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:18:15.840807Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.386524Z digest=sha256:9af4fb7f4f0aedea083581fa451618c5b8ee4ad34a83f19a294d33bdbfbb224b

Observation e9a13951-c116-49df-bff4-626a7bec7c0a · outbound

This paper cites How to Compute the Probability of a Word.

From Language Models over Tokens to Language Models over Characters How to Compute the Probability of a Word

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.388908Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.388908Z digest=sha256:46bbe43778409da61462c3dadf25a5179b2e4cc70e81f095f43263791d56f204

Observation d05fe6c9-8060-4772-b91c-baf953df0ccf · outbound

This paper cites Synchromesh: Reliable code generation from pre-trained language models.

From Language Models over Tokens to Language Models over Characters Synchromesh: Reliable code generation from pre-trained language models

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:18:15.832838Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.391821Z digest=sha256:26ee82e86a870ebee954c7c19b1725bf6e56f12caeebb2aeaba7cdc61be7fa9b

Observation e68da3e7-3dc7-411b-be9d-abe3782ccb45 · outbound

This paper cites Language models are unsupervised multitask learners.

From Language Models over Tokens to Language Models over Characters Language models are unsupervised multitask learners

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-11T22:18:15.825127Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.394300Z digest=sha256:0b8bb081394af8d10fbcf047c72b31011e875668697bd6059a65009f20fd7fe8

Observation e2fb611c-b487-42d3-ac72-814aac061e4c · outbound

This paper cites PICARD: parsing incrementally for constrained auto-regressive decoding from language models.

From Language Models over Tokens to Language Models over Characters PICARD: parsing incrementally for constrained auto-regressive decoding from language models

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.396908Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.396908Z digest=sha256:bed5f57fb14899c2d7c24c998148b967253c5e60e8ecd0c5ff0b33d5889f60ca

Observation b28c1f7b-8396-4b66-a640-ca8099d93a55 · outbound

This paper cites Neural machine translation of rare words with subword units.

From Language Models over Tokens to Language Models over Characters Neural machine translation of rare words with subword units

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.400329Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.400329Z digest=sha256:e4a4546c12e5afc0b15b8ad5dc7bdd116b9036cf90585b64f017aa0ab018dbb3

Observation db14f669-d2aa-4848-8b75-dc61461e8262 · outbound

This paper cites an unresolved cited work.

From Language Models over Tokens to Language Models over Characters Unresolved cited work

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.403029Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.403029Z digest=sha256:0d4e141f7f734b39760b9446db33a589d8e49f3368fb7090b1ec445abacaee5e

Observation 09f05709-d0f2-4ac5-8830-297cb30c079a · outbound

This paper cites From feedforward to recurrent LSTM neural networks for language modeling.

From Language Models over Tokens to Language Models over Characters From feedforward to recurrent LSTM neural networks for language modeling

Reference 30

Resolution
verified exact
raw_fallback, observed 2026-08-11T22:18:15.667863Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=arxiv_source observed=2026-08-11T22:18:15.405575Z digest=sha256:bc11b917d5371c62747713313eaea6e942b00ca44b5dfbaf927e4613ac82b607

Observation 06527b45-076a-4c6e-918f-87e912ccbb07 · outbound

This paper cites Attention Is All You Need.

From Language Models over Tokens to Language Models over Characters Attention Is All You Need

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.408041Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.408041Z digest=sha256:a645de101cc9b02e7fcbb0693e8f561841c0513045dddd751d5df2dc8a10ac56

Observation 0ad58d31-0587-4c36-812d-1b7baf47fe0c · outbound

This paper cites Efficient Guided Generation for Large Language Models.

From Language Models over Tokens to Language Models over Characters Efficient Guided Generation for Large Language Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.410786Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.410786Z digest=sha256:78cf9c17eaa1ad5051773eccf2a13dbd7da5e988b2c4aebb3affe7e3050d0762

Observation ff67263d-0c97-43b2-a07b-ea17c506e86a · outbound

This paper cites \ T ransformers: S tate-of-the-art natural language processing.

From Language Models over Tokens to Language Models over Characters \ T ransformers: S tate-of-the-art natural language processing

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-11T22:18:15.414687Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T22:18:15.414687Z digest=sha256:630dd247fb108c6d5becd3e5c0501be7391b0e1fb4ecbf39110731a75061e8b0

Pith citing papers

Observation 9b1df227-a42b-4f5f-8268-758708d528c7 · inbound

The Impact of Token Granularity on the Predictive Power of Language Model Surprisal cites this paper.

The Impact of Token Granularity on the Predictive Power of Language Model Surprisal From Language Models over Tokens to Language Models over Characters

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-11T14:30:05.141552Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-11T14:30:05.141552Z digest=sha256:fec633c924382fac3d5fbb97fda717fb5306a1d262da82988c5e728ebee143d2

Observation f0982b19-e0bb-4e0d-a9b6-360f351b2ac9 · inbound

Causal Estimation of Tokenisation Bias cites this paper.

Causal Estimation of Tokenisation Bias From Language Models over Tokens to Language Models over Characters

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T11:15:44.643052Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T11:15:44.643052Z digest=sha256:5134ccbfbac493715d4fce74a108d1e6276af90de8500acf875820f8a46b4d95

Observation 2a9b1b6e-9900-4adc-8969-3bc3476d0ede · inbound

The Harmonic Structure of Information Contours cites this paper.

The Harmonic Structure of Information Contours From Language Models over Tokens to Language Models over Characters

Reference 73

Resolution
unresolved
no resolver link, observed 2026-08-07T10:58:47.836882Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T10:58:47.836882Z digest=sha256:44d9409b3964c8447d38e061cbde12e664ab6cca70f2be80dfb5f35433591244

Observation adfa4472-f90c-49e5-bb8f-8cac585f3a33 · inbound

Sampling from Your Language Model One Byte at a Time cites this paper.

Sampling from Your Language Model One Byte at a Time From Language Models over Tokens to Language Models over Characters

Reference 75

Resolution
verified exact
arxiv_id, observed 2026-05-19T09:53:02.086678Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.

source=pdf_text observed=2026-05-19T09:52:20.923710Z digest=sha256:1b77020e740c655c3c33bbf96dfbe7ea8804f0cf7fed97e2375427b511149e8c

Observation ee9e9032-942b-4e24-827d-bf609c272e1d · inbound

A Spatio-Temporal Point Process for Fine-Grained Modeling of Reading Behavior cites this paper.

A Spatio-Temporal Point Process for Fine-Grained Modeling of Reading Behavior From Language Models over Tokens to Language Models over Characters

Reference 74

Resolution
unresolved
no resolver link, observed 2026-08-15T18:29:53.362352Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T18:29:53.362352Z digest=sha256:c97439537b0b3ffd250ffee7106b67cbb7b4f7a5b3775c85aa94b1c49072dae5

Observation 44689339-ce74-4f75-92d6-f565fc68fcc1 · inbound

Language Models are not Equally Robust to Non-Canonical Tokenization across Languages cites this paper.

Language Models are not Equally Robust to Non-Canonical Tokenization across Languages From Language Models over Tokens to Language Models over Characters

Reference 65

Resolution
unresolved
no resolver link, observed 2026-07-30T19:48:50.891887Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-30T19:48:50.891887Z digest=sha256:9b6e66efc0f7f79418e20781186834cec1affbb439ff9d825fad126073d30641