{"as_of":"2026-08-08T07:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7edb88cf84f9c91eea2dc7bc22ba15205b5c295e494039eea4b5bac2d23f3b80","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:08:36.997337Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T13:22:19.233640Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2405.17067","last_updated":"2025-05-15T15:57:32Z","snapshot_observed_at":"2026-07-06T18:20:31.458073Z","submitted_at":"2024-05-27T11:39:59Z","title":"Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization","version":2},"cited_work":{"arxiv_id":"2405.17067","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.17067","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tokenization matters! degrading large language models through challenging their tokenization","venue":null,"work_id":"e905cbd7-0973-4ac0-8ac8-490f7fc2f16e","year":2024},"citing_paper":{"arxiv_id":"2505.19261","last_updated":"2026-04-14T06:42:51Z","snapshot_observed_at":"2026-08-03T06:08:58.835346Z","submitted_at":"2025-05-25T18:33:05Z","title":"Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T13:19:20.215467Z"},"links":{"cited_paper":"/paper/2405.17067","citing_paper":"/paper/2505.19261"},"observation_digest":"sha256:e29e8fb573a0c6c260df3133d661cdaa4a4f308d23846e37c392ba32b144b3fe","observation_id":"e98f4c26-e3b2-4d26-8e56-9a215d2b698a","resolution":{"observed_at":"2026-05-19T13:22:19.235519Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17067","last_updated":"2025-05-15T15:57:32Z","snapshot_observed_at":"2026-07-06T18:20:31.458073Z","submitted_at":"2024-05-27T11:39:59Z","title":"Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17067","snapshot_observed_at":"2026-08-07T13:08:36.997337Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22645","last_updated":"2025-05-28T17:56:49Z","snapshot_observed_at":"2026-08-07T13:00:11.133396Z","submitted_at":"2025-05-28T17:56:49Z","title":"Characterizing Bias: Benchmarking Large Language Models in Simplified versus Traditional Chinese","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:08:36.997337Z"},"links":{"cited_paper":"/paper/2405.17067","citing_paper":"/paper/2505.22645"},"observation_digest":"sha256:7609364ca5fb80aa1df0f66487862a69599f70c712da19d9b0563f8caafb692c","observation_id":"2181d440-b5cf-4ce0-8452-4e3c5006006c","resolution":{"observed_at":"2026-08-07T13:08:36.997337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17067","last_updated":"2025-05-15T15:57:32Z","snapshot_observed_at":"2026-07-06T18:20:31.458073Z","submitted_at":"2024-05-27T11:39:59Z","title":"Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17067","snapshot_observed_at":"2026-08-07T11:15:44.719192Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03149","last_updated":"2025-06-03T17:59:47Z","snapshot_observed_at":"2026-08-07T11:05:38.670686Z","submitted_at":"2025-06-03T17:59:47Z","title":"Causal Estimation of Tokenisation Bias","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:15:44.719192Z"},"links":{"cited_paper":"/paper/2405.17067","citing_paper":"/paper/2506.03149"},"observation_digest":"sha256:ff2cc612bde958c2657809c7297e1047507260645d0421c4186b9c1704ba0b9e","observation_id":"cf7f876f-ef55-4b09-a7c7-52439b491d0e","resolution":{"observed_at":"2026-08-07T11:15:44.719192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17067","last_updated":"2025-05-15T15:57:32Z","snapshot_observed_at":"2026-07-06T18:20:31.458073Z","submitted_at":"2024-05-27T11:39:59Z","title":"Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17067","snapshot_observed_at":"2026-08-07T05:38:26.697578Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11115","last_updated":"2025-06-09T04:59:13Z","snapshot_observed_at":"2026-08-07T05:31:50.556045Z","submitted_at":"2025-06-09T04:59:13Z","title":"Incorporating Domain Knowledge into Materials Tokenization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T05:38:26.697578Z"},"links":{"cited_paper":"/paper/2405.17067","citing_paper":"/paper/2506.11115"},"observation_digest":"sha256:46eea93724330b0bd024a1f41752229ba78df66983fe57c53deb43f836abe604","observation_id":"45ff1f85-be70-4091-8d5e-bfe25bdfdada","resolution":{"observed_at":"2026-08-07T05:38:26.697578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17067","last_updated":"2025-05-15T15:57:32Z","snapshot_observed_at":"2026-07-06T18:20:31.458073Z","submitted_at":"2024-05-27T11:39:59Z","title":"Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17067","snapshot_observed_at":"2026-08-06T22:08:32.962081Z","title":"Tokenization matters! degrading large language models through challenging their tokenization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.22359","last_updated":"2025-06-27T16:20:18Z","snapshot_observed_at":"2026-08-06T22:03:23.392688Z","submitted_at":"2025-06-27T16:20:18Z","title":"Concept-Level AI for Telecom: Moving Beyond Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:08:32.962081Z"},"links":{"cited_paper":"/paper/2405.17067","citing_paper":"/paper/2506.22359"},"observation_digest":"sha256:35ea58033d19dc59bda50c63cdb0c89c31a6d9f2e4befe23fc04d532ae880290","observation_id":"f9e906c5-9e18-4f44-91dd-90d8e15033e8","resolution":{"observed_at":"2026-08-06T22:08:32.962081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17067","last_updated":"2025-05-15T15:57:32Z","snapshot_observed_at":"2026-07-06T18:20:31.458073Z","submitted_at":"2024-05-27T11:39:59Z","title":"Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17067","snapshot_observed_at":"2026-08-05T23:21:25.332133Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.05468","last_updated":"2025-08-07T15:11:17Z","snapshot_observed_at":"2026-08-08T07:10:46.950030Z","submitted_at":"2025-08-07T15:11:17Z","title":"TASE: Token Awareness and Structured Evaluation for Multilingual Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T23:21:25.332133Z"},"links":{"cited_paper":"/paper/2405.17067","citing_paper":"/paper/2508.05468"},"observation_digest":"sha256:a4b19808b6fd8c4c4bd540d61ed59d32b86c686292d5dd9dde74810e7585c955","observation_id":"d2677350-24e3-4787-ae30-5e5ea32b242f","resolution":{"observed_at":"2026-08-05T23:21:25.332133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17067","last_updated":"2025-05-15T15:57:32Z","snapshot_observed_at":"2026-07-06T18:20:31.458073Z","submitted_at":"2024-05-27T11:39:59Z","title":"Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17067","snapshot_observed_at":"2026-08-05T14:57:24.794551Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20718","last_updated":"2025-08-28T12:43:21Z","snapshot_observed_at":"2026-08-06T17:32:55.377722Z","submitted_at":"2025-08-28T12:43:21Z","title":"Addressing Tokenization Inconsistency in Steganography and Watermarking Based on Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T14:57:24.794551Z"},"links":{"cited_paper":"/paper/2405.17067","citing_paper":"/paper/2508.20718"},"observation_digest":"sha256:3e823fc224c1f1b3ce46a56e7cbabf999b3c2d839821c9d4028f07ea06cba03b","observation_id":"4652b3be-406b-4b73-b576-b13112a0d482","resolution":{"observed_at":"2026-08-05T14:57:24.794551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2405.17067/citation-record","integrity":"/paper/2405.17067/integrity","json":"/paper/2405.17067/citation-record.json","paper":"/paper/2405.17067"},"outbound":[],"paper":{"arxiv_id":"2405.17067","last_updated":"2025-05-15T15:57:32Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T18:20:31.458073Z","submitted_at":"2024-05-27T11:39:59Z","title":"Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2405.17067."}