{"as_of":"2026-08-13T03:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:45b5950bca0a6154e2db208b1691d632fa0da0251775619ee6abfd5f29b83d43","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:10:24.149417Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T08:35:02.870481Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T08:36:16.955692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"cited_work":{"arxiv_id":"2411.18553","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.18553","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Retrofitting large language models with dynamic tokenization","venue":null,"work_id":"3a1e8dde-49e0-4faf-8438-98ac09571e3a","year":2025},"citing_paper":{"arxiv_id":"2605.22005","last_updated":"2026-05-21T05:02:51Z","snapshot_observed_at":"2026-08-04T14:57:02.121312Z","submitted_at":"2026-05-21T05:02:51Z","title":"Check Your LLM's Secret Dictionary! Five Lines of Code Reveal What Your LLM Learned (Including What It Shouldn't Have)","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-22T08:35:02.870481Z"},"links":{"cited_paper":"/paper/2411.18553","citing_paper":"/paper/2605.22005"},"observation_digest":"sha256:ee0841a73c557a27be7341b3981baa6b0a156effbbf788ab678c2c59d4264bd6","observation_id":"879b6887-3e87-4e8f-a51d-2844504486eb","resolution":{"observed_at":"2026-05-22T08:36:16.959568Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.18553/citation-record","integrity":"/paper/2411.18553/integrity","json":"/paper/2411.18553/citation-record.json","paper":"/paper/2411.18553"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:23.992803Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:23.992803Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:f81a929c9309b35e745a8beb9d99d5bc9d85f100739fe9d7070192dc6eae9afa","observation_id":"0c649ff6-10d4-4fde-9ee6-78be1e05d81a","resolution":{"observed_at":"2026-08-12T11:10:23.992803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.604408Z","title":null,"venue":null,"work_id":"691516be-eb5b-4683-acbd-5130a9b7cdac","year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:23.996416Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:590b6758ad1c50d6af8a4cab4d2f88491f899e5082791f436daa7d9c063ff843","observation_id":"73ff951d-33e5-4423-b7b8-dae9ec93bcc8","resolution":{"observed_at":"2026-08-12T11:10:24.607344Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:23.999428Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:23.999428Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:bb6b025e67b787af8db92a88c3bae3ce1117ae3132e8410a8d300dc6a08c6c6a","observation_id":"46770099-e3bb-45f8-b13d-ee1fccca925e","resolution":{"observed_at":"2026-08-12T11:10:23.999428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.006477Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.006477Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:fe07ac47716ffca3072bc939a1ad8e55a15570666d45b0a00a1f0722e80449ef","observation_id":"9e81f331-52cb-4d2f-8c76-79d52d460ac0","resolution":{"observed_at":"2026-08-12T11:10:24.006477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.009769Z","title":"Clark, Dan Garrette, Iulia Turc, and John Wieting","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.009769Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:16af7d0452b88782fd6178efa281c8db7ffe42ffc85b12276cc902693208f287","observation_id":"2802611a-9c59-4d4f-b280-8862032746c8","resolution":{"observed_at":"2026-08-12T11:10:24.009769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.012732Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.012732Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:a2baa860c9a669affe2a30fa838990b7ff443792f6ec08fae408377bd4a1a06f","observation_id":"d6fa0937-25d1-4527-81b3-57d7c429415c","resolution":{"observed_at":"2026-08-12T11:10:24.012732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.016043Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.016043Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:81b973a367fe8610a22123b5564457342b4e6492cb047b672098d95d3030d8df","observation_id":"e4c3349b-a7d7-4f94-a059-84c9cadfb101","resolution":{"observed_at":"2026-08-12T11:10:24.016043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01035","last_updated":"2024-02-07T10:51:11Z","snapshot_observed_at":"2026-08-10T18:44:13.503788Z","submitted_at":"2024-02-01T21:49:34Z","title":"Getting the most out of your tokenizer for pre-training and domain adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01035","snapshot_observed_at":"2026-08-12T11:10:24.019296Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.019296Z"},"links":{"cited_paper":"/paper/2402.01035","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:7a991c2dea9c44483f8481f58bc01d4128891891890e1bd78884db277fc7a366","observation_id":"ea17c559-aae4-40c8-9a93-f83879e8a1f3","resolution":{"observed_at":"2026-08-12T11:10:24.019296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.022265Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.022265Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:b3ebc0da1b321c7bffa3e34debcf553919c8cf502b877b2be49a54d2ce782031","observation_id":"6a2e255c-e158-4bdb-a9cd-a2292dfdd828","resolution":{"observed_at":"2026-08-12T11:10:24.022265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.025265Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.025265Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:c8c12b6b9b4461759cd8c0f893794366877734a067928d9c186314eeaddb453e","observation_id":"0da596d8-e077-48f6-832d-74e8481f81e3","resolution":{"observed_at":"2026-08-12T11:10:24.025265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.028049Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.028049Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:064650be2088475f904aec284fab116bdd6b4afa1d8053cad38db1035a12f503","observation_id":"77d9aa65-93da-4839-9d0d-16e0ad2a5ab6","resolution":{"observed_at":"2026-08-12T11:10:24.028049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-srw.5","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.236710Z","title":null,"venue":null,"work_id":"43929a6d-3d92-4743-b637-d2f8d2518eca","year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.030869Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:7f2f12381aaf478778c1491756a7cc7c883ad1d6a8b42d57434dc45e2a810e46","observation_id":"97b0b7db-930c-48f0-98fc-b4dc4098173f","resolution":{"observed_at":"2026-08-12T11:10:24.240824Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.034520Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.034520Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:a6d0fdb9dc82fe0a3b756e65bcf999a67ad1383ac42ead671096bc249daa1fa6","observation_id":"87a47947-2d99-4750-809c-3954aef60e8e","resolution":{"observed_at":"2026-08-12T11:10:24.034520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02989","last_updated":"2024-12-15T07:07:28Z","snapshot_observed_at":"2026-08-13T00:21:09.352743Z","submitted_at":"2023-10-04T17:26:16Z","title":"xVal: A Continuous Numerical Tokenization for Scientific Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02989","snapshot_observed_at":"2026-08-12T11:10:24.037284Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.037284Z"},"links":{"cited_paper":"/paper/2310.02989","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:4e2cd2bde2d77c60e532b5826e4a6c1201baae06f4de3f494c19c14aa0a4065a","observation_id":"c54f7768-dafa-44b9-b1a4-e8c8924d2bc7","resolution":{"observed_at":"2026-08-12T11:10:24.037284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.595163Z","title":null,"venue":null,"work_id":"0274fdb0-af41-4b99-bb42-6de20f2a10a4","year":2020},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.040291Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:34ce85ac043610e22dc4e746990f4535a67ee65f2a413f4bc3791945a9ff741f","observation_id":"695b67a2-54e3-421a-a675-473357b39e48","resolution":{"observed_at":"2026-08-12T11:10:24.598759Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.042986Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.042986Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:d57fc4accd0fbb991700ffd96f793800e08c553f06174d248709167aba742a57","observation_id":"28fd35a5-3066-486a-a852-8573879d5dca","resolution":{"observed_at":"2026-08-12T11:10:24.042986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.045740Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen - Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.045740Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:05ca2e34c30d18d7e99b53b4d8ea5c0fdd727d3c9bf8582b36b513f310959fde","observation_id":"18748b94-7a0b-4b5c-b2b9-9b6c9e3e95d6","resolution":{"observed_at":"2026-08-12T11:10:24.045740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-12T11:10:24.049510Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.049510Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:b740c6d4b9171a5b96714019c50ee7b259124f6d3b6583ed1f02edec3f2ad011","observation_id":"c58afe74-f5c5-4608-9f97-1fbb6a07aabb","resolution":{"observed_at":"2026-08-12T11:10:24.049510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.052596Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.052596Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:0abc4746188f8561029c4b663d619810cc3de1b33ea30497f7746dde7486e38e","observation_id":"1aac469e-0b55-4782-b2c6-bfb996e28771","resolution":{"observed_at":"2026-08-12T11:10:24.052596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.055521Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.055521Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:fd70c5ab2ab3f0f17d0a682cf19fdb5afcc8d5b0e3cac4a143f9dfbd362deadb","observation_id":"5f950c0b-4858-4d0e-a1cb-9a23556b68db","resolution":{"observed_at":"2026-08-12T11:10:24.055521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.058306Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.058306Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:0902db90d9cf12c5bc2674e388452f54c51fbf09699bde6728b65c456b43fa91","observation_id":"ae6a5188-7be6-4e00-8229-9a75905d0ed4","resolution":{"observed_at":"2026-08-12T11:10:24.058306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.577930Z","title":null,"venue":null,"work_id":"c377c0f7-8633-4a32-89fe-2d7189e6ab25","year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.061248Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:5a08d38e43b202716fd318fd28a1ba4d8a396c4deb7cc434a1dcadb48606fdab","observation_id":"b25c5602-c8bf-4107-a514-f2ed9049ca9c","resolution":{"observed_at":"2026-08-12T11:10:24.581172Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19325","last_updated":"2025-04-25T01:08:35Z","snapshot_observed_at":"2026-08-12T23:54:55.669531Z","submitted_at":"2024-05-29T17:55:03Z","title":"Nearest Neighbor Speculative Decoding for LLM Generation and Attribution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.19325","snapshot_observed_at":"2026-08-12T11:10:24.063902Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.063902Z"},"links":{"cited_paper":"/paper/2405.19325","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:e80f0ecc73944fa5a32af530059a8efcf68396dead68cbb0c889aa9cf9979733","observation_id":"368e064a-9cab-412f-8f2c-c58f1d0a5ebb","resolution":{"observed_at":"2026-08-12T11:10:24.063902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.067616Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.067616Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:93c7b2858af60e86c17e31191fb12449ae35aa4a18769136c72aefd2e0f3c7f1","observation_id":"c91936f2-1926-46d3-adb5-2ef5551cd716","resolution":{"observed_at":"2026-08-12T11:10:24.067616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.070790Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.070790Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:5028532ce652debdf505e630bf1892ce9ca3ac5b3d263913c550dee38210012d","observation_id":"59ced813-ec55-4e0b-850e-6ee63ca3158b","resolution":{"observed_at":"2026-08-12T11:10:24.070790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.569592Z","title":null,"venue":null,"work_id":"5bc92edb-7219-41cf-9183-fbbc6c3e711a","year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.073599Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:1b6f6629beb12c35184c7399a317aa6e818df3c3e8e2f86da4be363d5ac8fd4c","observation_id":"ebb72ef0-dcd2-4280-a36e-c3494da59f4c","resolution":{"observed_at":"2026-08-12T11:10:24.572555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.560920Z","title":null,"venue":null,"work_id":"ecb5da46-6d17-445a-a109-71ad08d59fb3","year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.076224Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:c59da9643da704579168c8611918525c4a57fa3251b64ff1f0e801f7ca347b34","observation_id":"6c71c637-14e7-4074-ada6-cdc88767d9c1","resolution":{"observed_at":"2026-08-12T11:10:24.563838Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.10508","last_updated":"2021-12-20T13:04:18Z","snapshot_observed_at":"2026-07-06T12:20:36.165718Z","submitted_at":"2021-12-20T13:04:18Z","title":"Between words and characters: A Brief History of Open-Vocabulary Modeling and Tokenization in NLP","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.10508","snapshot_observed_at":"2026-08-12T11:10:24.080095Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.080095Z"},"links":{"cited_paper":"/paper/2112.10508","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:3ba8706d0a7201a2c5719fed0e30ec95f7b507deb3d6d334706b5046aa9cbc86","observation_id":"b934043f-571b-40a2-9db3-f0a287490f72","resolution":{"observed_at":"2026-08-12T11:10:24.080095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06196","last_updated":"2025-03-23T14:51:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-09T05:37:09Z","title":"Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06196","snapshot_observed_at":"2026-08-12T11:10:24.083433Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.083433Z"},"links":{"cited_paper":"/paper/2402.06196","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:e361d7d0e5ae02ae891146448ad08d3a8c13878f42f1e61b6060786319363771","observation_id":"8fa8b262-0c98-4a29-8914-f5bad516d75b","resolution":{"observed_at":"2026-08-12T11:10:24.083433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.086600Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.086600Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:05df571622da94294181807bff0528b39b86bb072ed84e1ae30a4038fc0f3b00","observation_id":"1b83bc81-36be-4758-91c3-ba34518a85ca","resolution":{"observed_at":"2026-08-12T11:10:24.086600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.090210Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.090210Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:b2d0107e723ec19652854fe36d66aa46cd16166f3653269bed842e8da0d5cea5","observation_id":"4eac5368-7150-4195-aa8a-9d43bc0651c6","resolution":{"observed_at":"2026-08-12T11:10:24.090210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.092914Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.092914Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:19f482bce95596726f044efcaa7440d8a82a95783c6acdf3428fd919c4d45201","observation_id":"bc7d2e14-363e-4011-a617-75cbc356dc4c","resolution":{"observed_at":"2026-08-12T11:10:24.092914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.095839Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.095839Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:e0d83596ffffdaf801a4a42cab24241961b5eddcc6af3cfe4ffba7a1cd1eae51","observation_id":"0a60cb4f-2b74-4cfb-94da-c08d70bf0c8e","resolution":{"observed_at":"2026-08-12T11:10:24.095839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.098736Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.098736Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:9a214fc394c14247d107a5f1a403c87e8b3028dcd657afb100a3d05b7d653ed0","observation_id":"56120d6d-bd18-4df5-b3df-551858d092a1","resolution":{"observed_at":"2026-08-12T11:10:24.098736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.102212Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.102212Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:a22800959bc01f998ec02bb4f39ad720620bb1d510b404dce33d3a0612544aff","observation_id":"2f41f494-f3e8-484a-a88e-21d2f0c98710","resolution":{"observed_at":"2026-08-12T11:10:24.102212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.105058Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.105058Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:cd78e97128a20f5089585e44209f6d296246c8345a248c2a3716627cb3920da0","observation_id":"3e0ea1c6-a3cf-410c-b844-fcd0f5612544","resolution":{"observed_at":"2026-08-12T11:10:24.105058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.107858Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.107858Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:6553435c73da44598d853ad0f16f7119b318b9eaec19b365d8dba9f1461656e4","observation_id":"8941746f-b137-4845-a1a2-c8c7428c3c5c","resolution":{"observed_at":"2026-08-12T11:10:24.107858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.111844Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.111844Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:b1c4e4cf4126c91b3590443146c656f24c6751bf41fd1cb594f1eeff848bd21d","observation_id":"8107a85b-ecdd-4316-914b-9ca760d0c723","resolution":{"observed_at":"2026-08-12T11:10:24.111844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03304","last_updated":"2025-02-19T13:30:23Z","snapshot_observed_at":"2026-08-11T22:30:47.514883Z","submitted_at":"2024-12-04T13:27:09Z","title":"Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03304","snapshot_observed_at":"2026-08-12T11:10:24.114765Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.114765Z"},"links":{"cited_paper":"/paper/2412.03304","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:402b3105b5e50679b95ef9db0bb70722a6621b864a1ba2f06977487dfd591b35","observation_id":"214cf2cc-044c-49bf-a8c9-bad74686fefc","resolution":{"observed_at":"2026-08-12T11:10:24.114765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.04985","last_updated":"2020-02-27T22:07:11Z","snapshot_observed_at":"2026-08-12T17:40:57.385798Z","submitted_at":"2020-02-27T22:07:11Z","title":"Adv-BERT: BERT is not robust on misspellings! Generating nature adversarial samples on BERT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.04985","snapshot_observed_at":"2026-08-12T11:10:24.117637Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.117637Z"},"links":{"cited_paper":"/paper/2003.04985","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:cde7f0f929dd53f1c127c30f3f12752b1d6d1df7772b9905926df2ecae5fa4c3","observation_id":"847b2585-6299-4047-8f99-bd312f675f08","resolution":{"observed_at":"2026-08-12T11:10:24.117637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.550723Z","title":"Tran, Sebastian Ruder, Jai Prakash Gupta, Hyung Won Chung, Dara Bahri, Zhen Qin, Simon Baumgartner, Cong Yu, and Donald Metzler","venue":null,"work_id":"daacd029-c21f-4022-8820-72e90ceb6aaf","year":2022},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.120592Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:b950d055b318b09a268804e2885ebcb9c7cb7fba8f5666bf3b1374356cd173bd","observation_id":"179c1195-742a-42ac-9b66-8793acf74c85","resolution":{"observed_at":"2026-08-12T11:10:24.554279Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.124139Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.124139Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:5333923468a126b3d3f75c003ca8bbb97bf497c1aaeebf209eb04f6ba6ec5e68","observation_id":"6d8078d3-e2d4-4993-a615-570690c11d1a","resolution":{"observed_at":"2026-08-12T11:10:24.124139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-12T11:10:24.126793Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.126793Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:69da0e8bd3b8ee62c6aa8baf8bb01d8c31f314e9433504ad9262878085f50ee8","observation_id":"ff9197a8-d4cb-4a3d-9659-2e8bd6ed117c","resolution":{"observed_at":"2026-08-12T11:10:24.126793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.01289","last_updated":"2024-05-31T08:07:45Z","snapshot_observed_at":"2026-08-11T21:26:11.769011Z","submitted_at":"2024-03-02T19:01:40Z","title":"Greed is All You Need: An Evaluation of Tokenizer Inference Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.01289","snapshot_observed_at":"2026-08-12T11:10:24.129617Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.129617Z"},"links":{"cited_paper":"/paper/2403.01289","citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:d3c02ca2ee7351685f6c40cf1544d98b470cb557f56f51b31d573b3fd752315a","observation_id":"7c7c19f5-056c-4177-a71b-1858c4ecd813","resolution":{"observed_at":"2026-08-12T11:10:24.129617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.132464Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.132464Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:ae25b7cdef3adce84caee9433357e016770b677aba1d16815e1dc4c1a6f8e286","observation_id":"f824032e-5a6b-4e84-a3fb-36e13217ba31","resolution":{"observed_at":"2026-08-12T11:10:24.132464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.537370Z","title":"Xu, Uri Alon, and Graham Neubig","venue":null,"work_id":"ab31db1a-67db-40a2-9f71-8e525a2412fc","year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.135291Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:7a1be9f36037b4ceacd9087f9415937b41e2d630df5fd41c81a71f05cd8b432a","observation_id":"e78dfc47-2ae5-4db0-b567-ef1ec2073734","resolution":{"observed_at":"2026-08-12T11:10:24.540351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.138161Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.138161Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:75a527c0e3b75f7c3f3b046972910dce16042c6f03b6d6861055099f31eb295e","observation_id":"2020368a-31f0-4490-9f33-284553ea8536","resolution":{"observed_at":"2026-08-12T11:10:24.138161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.528982Z","title":null,"venue":null,"work_id":"e3cecdcf-3d0c-4fa8-a56a-647d37f17206","year":2018},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.140991Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:2855eaf9ad7ffa2cb06821baffb6f0c8b86383e7e8c6b0b4eb8cc2322a85a538","observation_id":"4897db97-eee7-43f9-9c0f-b5180fa826fc","resolution":{"observed_at":"2026-08-12T11:10:24.531860Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.520551Z","title":null,"venue":null,"work_id":"e08e9463-cb86-42dc-ba22-f79ec1e7d577","year":2023},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.143640Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:09dc99033ceca5c85244e4956dc5c3a57a0b4b504ab63fbf140e43fdaca0bc3b","observation_id":"694dc63d-7bd4-494e-be2b-8a4c609198b7","resolution":{"observed_at":"2026-08-12T11:10:24.523433Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.146330Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.146330Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:52aabfe755d4191bd879ef6f039ec5a2c64b3c79bb2d0db9709925a684ca6ecc","observation_id":"9a00afb8-6ccd-47aa-b981-29ccd21c0919","resolution":{"observed_at":"2026-08-12T11:10:24.146330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T11:10:24.149417Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization","version":3},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-12T11:10:24.149417Z"},"links":{"citing_paper":"/paper/2411.18553"},"observation_digest":"sha256:796212f50bf84ad4aa8f923ed51fec018636800f2f867d6b253437c603cb29c6","observation_id":"4761b0ec-5945-44c5-aedb-85ea5f670efd","resolution":{"observed_at":"2026-08-12T11:10:24.149417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.18553","last_updated":"2025-06-11T13:08:24Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T17:41:26.758040Z","submitted_at":"2024-11-27T17:51:58Z","title":"Retrofitting Large Language Models with Dynamic Tokenization"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":48,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2411.18553."}