{"as_of":"2026-08-08T16:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b73fc5159794df003999dda45ec584af52cd6b83df64774a86c3bc8434dd1ea2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:32:25.383880Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":29,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-07T14:32:25.383880Z","title":"Language model tokenizers introduce unfairness between languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18638","last_updated":"2025-05-29T17:11:54Z","snapshot_observed_at":"2026-08-08T01:26:51.326550Z","submitted_at":"2025-05-24T11:01:05Z","title":"Multilingual Question Answering in Low-Resource Settings: A Dzongkha-English Benchmark for Foundation Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:32:25.383880Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2505.18638"},"observation_digest":"sha256:1e43e9655a15a2ca63d06c2358ab2beaf2ebf0b7b47a032abd55036268f447ea","observation_id":"5493db6b-1d07-41e4-a038-85a36e15f45b","resolution":{"observed_at":"2026-08-07T14:32:25.383880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-07T13:12:00.875465Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22582","last_updated":"2025-05-28T16:54:53Z","snapshot_observed_at":"2026-08-08T01:29:39.987815Z","submitted_at":"2025-05-28T16:54:53Z","title":"Less, but Better: Efficient Multilingual Expansion for LLMs via Layer-wise Mixture-of-Experts","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:12:00.875465Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2505.22582"},"observation_digest":"sha256:69c66e66d5553e5bb0b1b21004fc8a6fce4474a229a2389e40e103086149fc25","observation_id":"1121a55b-fb62-46b6-b0d0-c893765cad1f","resolution":{"observed_at":"2026-08-07T13:12:00.875465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-07T11:15:43.589887Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03149","last_updated":"2025-06-03T17:59:47Z","snapshot_observed_at":"2026-08-07T11:05:38.670686Z","submitted_at":"2025-06-03T17:59:47Z","title":"Causal Estimation of Tokenisation Bias","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:15:43.589887Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2506.03149"},"observation_digest":"sha256:d512cc5346d66f6165c65d906a173b0668a819d62fe3b36a294765e360e47126","observation_id":"2108986b-cfda-40b9-b2b3-3d827f213f76","resolution":{"observed_at":"2026-08-07T11:15:43.589887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2601.14958","last_updated":"2026-05-08T04:01:13Z","snapshot_observed_at":"2026-07-06T22:42:26.083572Z","submitted_at":"2026-01-21T12:58:46Z","title":"Script Sensitivity: Benchmarking Language Models on Unicode, Romanized and Mixed-Script Sinhala","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T12:36:27.421985Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2601.14958"},"observation_digest":"sha256:a3b5d8707c4639e234b30dfee47c542ebcabb73f53a46decc93a4eec7f5811f1","observation_id":"a4448f31-a4c7-4396-90ac-f0d963686242","resolution":{"observed_at":"2026-05-16T12:37:53.013482Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2604.17512","last_updated":"2026-04-19T16:05:33Z","snapshot_observed_at":"2026-07-29T17:45:26.538909Z","submitted_at":"2026-04-19T16:05:33Z","title":"ONTO: A Token-Efficient Columnar Notation for LLM Input Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-10T05:21:56.826488Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2604.17512"},"observation_digest":"sha256:db8492b16c8baef0dd29524f1d3cc52d5713d49ed251e2fe579328aef7b78a65","observation_id":"487f9c6b-8106-4cad-9807-69ef24b82406","resolution":{"observed_at":"2026-05-10T09:23:37.781850Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.14890","last_updated":"2026-05-18T08:33:19Z","snapshot_observed_at":"2026-08-02T04:12:02.710800Z","submitted_at":"2026-05-14T14:35:05Z","title":"Tokenizer Fertility and Zero-Shot Performance of Foundation Models on Ukrainian Legal Text: A Comparative Study","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-20T21:08:44.929762Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.14890"},"observation_digest":"sha256:cdbeac142ff2338dbb8aeeb4dbde276b3cbf6d536959d3379748154b2697684f","observation_id":"f4f19e13-e5cb-451f-860c-91646d30f46c","resolution":{"observed_at":"2026-05-20T21:09:02.558978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.16538","last_updated":"2026-05-15T18:33:46Z","snapshot_observed_at":"2026-07-06T23:27:38.955917Z","submitted_at":"2026-05-15T18:33:46Z","title":"LLMs in Qualitative Research: Opportunities, Limitations, and Practical Considerations","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-20T15:59:56.231210Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.16538"},"observation_digest":"sha256:fff85322d29f882fb0cd16cc06d43258852f420b4d126cf570ee20d12a60299b","observation_id":"54ff702d-6fd9-47d9-af6c-f107095d4e8e","resolution":{"observed_at":"2026-05-20T16:03:33.014552Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.22705","last_updated":"2026-05-26T17:59:39Z","snapshot_observed_at":"2026-07-06T23:32:59.663926Z","submitted_at":"2026-05-21T16:46:23Z","title":"Tokenization with Split Trees","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-22T05:48:29.391178Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.22705"},"observation_digest":"sha256:391ec0e1ea0bfef9bfb6a78da009758229ede8dfdf0f994c35d3073796e23dbd","observation_id":"fb7e9804-4133-4a84-a9e0-8ffa26f9554d","resolution":{"observed_at":"2026-05-22T05:51:08.838187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.24718","last_updated":"2026-05-23T20:13:44Z","snapshot_observed_at":"2026-08-07T15:18:00.875763Z","submitted_at":"2026-05-23T20:13:44Z","title":"The Tokenizer Tax Across 25 European Languages: Domain Invariance, Cross-Lingual Few-Shot Effects, and the Ukrainian Penalty","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T13:08:33.172423Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.24718"},"observation_digest":"sha256:275cc9b8c38243ee25a3a1ab5d65e2c3b973dcb4f07c785464f839d6419ad8cc","observation_id":"899c837d-d4cd-46af-94a5-8b9f213d26de","resolution":{"observed_at":"2026-06-30T13:14:40.909415Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":"2305.15425","doi":"10.48550/arxiv.2305.15425","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","venue":"arXiv (Cornell University)","work_id":"4794e7c1-437b-4edd-a5f0-aa259547a9be","year":2023},"citing_paper":{"arxiv_id":"2605.29379","last_updated":"2026-05-28T05:29:12Z","snapshot_observed_at":"2026-07-06T23:38:46.361360Z","submitted_at":"2026-05-28T05:29:12Z","title":"BrahmicTokenizer-131K: An Indic-Capable Drop-In Replacement for o200k_base","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-29T08:12:16.235649Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2605.29379"},"observation_digest":"sha256:a1064dbe50d05c08fde4a530002adea732c4166e52877260e20a6ba1b251734d","observation_id":"b2321e79-237a-41f1-a0db-c5d3bd003ee3","resolution":{"observed_at":"2026-06-29T08:13:14.768133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T00:53:34.61108+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-08-02T02:01:38.447490Z","title":"José Pombal, Dongkeun Yoon, Patrick Fernandes, Ian Wu, Seungone Kim, Ricardo Rei, Graham Neubig, and André F","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14480","last_updated":"2026-07-21T06:28:06Z","snapshot_observed_at":"2026-08-02T02:01:36.054949Z","submitted_at":"2026-07-16T01:53:09Z","title":"Lower-Resource, Higher Scores: Language Bias in LLM Evaluators","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T02:01:38.447490Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2607.14480"},"observation_digest":"sha256:4bd3dc05d1b9542f42e30b2793cc2ee6eeac37849bd20345ee991be3c90b3949","observation_id":"69bdf272-e63f-4d5d-9a5d-062dab6f10de","resolution":{"observed_at":"2026-08-02T02:01:38.447490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15425","snapshot_observed_at":"2026-07-31T23:49:11.023254Z","title":"Torr, and Adel Bibi","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.23319","last_updated":"2026-07-25T18:23:06Z","snapshot_observed_at":"2026-07-31T23:49:10.129985Z","submitted_at":"2026-07-25T18:23:06Z","title":"BHARATI: Morphology-Aware Tokenizers for Classical Indian Languages with Subword Fertility Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T23:49:11.023254Z"},"links":{"cited_paper":"/paper/2305.15425","citing_paper":"/paper/2607.23319"},"observation_digest":"sha256:ec46c2bc7235f0c67974d90de1fbc40f48da56bdd0564aea875d179783035c0f","observation_id":"8afba8f7-16bf-4d88-83a8-5fab1838c950","resolution":{"observed_at":"2026-07-31T23:49:11.023254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.15425/citation-record","integrity":"/paper/2305.15425/integrity","json":"/paper/2305.15425/citation-record.json","paper":"/paper/2305.15425"},"outbound":[],"paper":{"arxiv_id":"2305.15425","last_updated":"2023-10-20T10:09:55Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T15:32:49.322000Z","submitted_at":"2023-05-17T14:17:57Z","title":"Language Model Tokenizers Introduce Unfairness Between Languages"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2305.15425."}