{"as_of":"2026-08-20T19:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c1647bc0d18e2d78d1ba0b398268daed475d0441dacdeb5dc8b84d5063451fe4","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T19:30:02.530814Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T13:36:59.084320Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14714","snapshot_observed_at":"2026-08-12T19:30:02.530814Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04474","last_updated":"2024-11-16T02:13:54Z","snapshot_observed_at":"2026-08-16T12:35:12.711300Z","submitted_at":"2024-11-16T02:13:54Z","title":"NSTRI Global Collaborative Research Data Platform","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T19:30:02.530814Z"},"links":{"cited_paper":"/paper/2402.14714","citing_paper":"/paper/2412.04474"},"observation_digest":"sha256:943837a23b0b0f5709810b7f199dce2fbc543381611122f45dee5416a4a34e2e","observation_id":"3ef1570c-6b25-4b70-94b6-e48d73fd1cfb","resolution":{"observed_at":"2026-08-12T19:30:02.530814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14714","snapshot_observed_at":"2026-08-11T15:04:55.971691Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11376","last_updated":"2024-12-16T02:04:06Z","snapshot_observed_at":"2026-08-18T23:59:51.387777Z","submitted_at":"2024-12-16T02:04:06Z","title":"ChatTime: A Unified Multimodal Time Series Foundation Model Bridging Numerical and Textual Data","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T15:04:55.971691Z"},"links":{"cited_paper":"/paper/2402.14714","citing_paper":"/paper/2412.11376"},"observation_digest":"sha256:adc77fc78283142b7c3a0b4d3e6a2bb416608f7fd0fff68bf1d1ee0aa5ff2c37","observation_id":"8c0a8dbb-5f6c-404c-946e-6f23a325cd10","resolution":{"observed_at":"2026-08-11T15:04:55.971691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models","version":1},"cited_work":{"arxiv_id":"2402.14714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14714","snapshot_observed_at":"2026-07-02T13:36:59.084320Z","title":"likely”, “unlike","venue":null,"work_id":"2ab8fabb-b8a6-4e48-bd54-074f5f876472","year":2024},"citing_paper":{"arxiv_id":"2510.17001","last_updated":"2026-04-20T09:49:51Z","snapshot_observed_at":"2026-08-02T08:09:49.675839Z","submitted_at":"2025-10-19T20:56:58Z","title":"Vocab Diet: Reshaping the Vocabulary of LLMs via Vector Arithmetic","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T05:54:04.948619Z"},"links":{"cited_paper":"/paper/2402.14714","citing_paper":"/paper/2510.17001"},"observation_digest":"sha256:6bdf908549b818863cfc3269c00ec9638d267274108406af3ace96f0e7b839e8","observation_id":"66cc8f46-1af4-4c6c-8ce9-176af3c6ce1c","resolution":{"observed_at":"2026-05-18T05:55:56.669018Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models","version":1},"cited_work":{"arxiv_id":"2402.14714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14714","snapshot_observed_at":"2026-07-02T13:36:59.084320Z","title":"likely”, “unlike","venue":null,"work_id":"2ab8fabb-b8a6-4e48-bd54-074f5f876472","year":2024},"citing_paper":{"arxiv_id":"2605.26002","last_updated":"2026-05-25T16:20:03Z","snapshot_observed_at":"2026-08-15T08:52:36.509421Z","submitted_at":"2026-05-25T16:20:03Z","title":"SemBridge: Language Transfer in Sparse Encoders via Multilingual Semantic Bridges","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-29T20:14:42.935210Z"},"links":{"cited_paper":"/paper/2402.14714","citing_paper":"/paper/2605.26002"},"observation_digest":"sha256:5dde0e9c2e753fe99a9a8060a8d1958bd835ab8d62ec8e91c91bb7043c9b9430","observation_id":"18174954-81b2-40d2-897c-de292014dfc0","resolution":{"observed_at":"2026-07-01T16:45:51.404034Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models","version":1},"cited_work":{"arxiv_id":"2402.14714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14714","snapshot_observed_at":"2026-07-02T13:36:59.084320Z","title":"likely”, “unlike","venue":null,"work_id":"2ab8fabb-b8a6-4e48-bd54-074f5f876472","year":2024},"citing_paper":{"arxiv_id":"2606.02834","last_updated":"2026-06-01T19:56:02Z","snapshot_observed_at":"2026-08-18T22:05:52.030100Z","submitted_at":"2026-06-01T19:56:02Z","title":"Large Byte Model: Teaching Language Models About Compiled Code","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T13:47:15.984105Z"},"links":{"cited_paper":"/paper/2402.14714","citing_paper":"/paper/2606.02834"},"observation_digest":"sha256:0b65549716bbc521c6c688d61913f04d94b48b28da4da894367a8718e535bb7e","observation_id":"d7101fdf-6abd-42c1-a26f-6944d4f8b24f","resolution":{"observed_at":"2026-07-01T23:56:24.022902Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models","version":1},"cited_work":{"arxiv_id":"2402.14714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.14714","snapshot_observed_at":"2026-07-02T13:36:59.084320Z","title":"likely”, “unlike","venue":null,"work_id":"2ab8fabb-b8a6-4e48-bd54-074f5f876472","year":2024},"citing_paper":{"arxiv_id":"2606.06738","last_updated":"2026-06-04T21:51:50Z","snapshot_observed_at":"2026-08-16T12:43:58.830618Z","submitted_at":"2026-06-04T21:51:50Z","title":"Modular Monolingual Adaptation using Pretrained Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-28T01:11:42.032901Z"},"links":{"cited_paper":"/paper/2402.14714","citing_paper":"/paper/2606.06738"},"observation_digest":"sha256:2be9cb5ba752f5a7125835b2355d4fda7e5f1801ac91c7cfa60537605f6a6756","observation_id":"f481fdd3-ebd3-41e5-bc5f-ae9d0f49274c","resolution":{"observed_at":"2026-07-02T13:36:59.085868Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14714","snapshot_observed_at":"2026-08-01T23:53:32.151334Z","title":"arXiv preprint arXiv:2402.14714","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.15209","last_updated":"2026-08-18T08:58:42Z","snapshot_observed_at":"2026-08-20T19:17:44.142868Z","submitted_at":"2026-07-16T17:08:28Z","title":"Expanding the Lexicon of Ge'ez Based African Languages: A Comparative Study of Amharic and Tigrinya","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T23:53:32.151334Z"},"links":{"cited_paper":"/paper/2402.14714","citing_paper":"/paper/2607.15209"},"observation_digest":"sha256:219ec569b12888296bb72ad2ba89595961fdd7f55f3bb01713b1f75f6b7270e4","observation_id":"bc0c8906-ead6-4ee4-b362-e75cfa0b02cf","resolution":{"observed_at":"2026-08-01T23:53:32.151334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14714","snapshot_observed_at":"2026-08-01T23:50:15.667569Z","title":"Efficient and effective vocabulary expansion to- wards multilingual large language models.arXiv preprint arXiv:2402.14714,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15232","last_updated":"2026-07-16T17:32:38Z","snapshot_observed_at":"2026-08-19T01:31:35.031839Z","submitted_at":"2026-07-16T17:32:38Z","title":"In-Place Tokenizer Expansion for Pre-trained LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T23:50:15.667569Z"},"links":{"cited_paper":"/paper/2402.14714","citing_paper":"/paper/2607.15232"},"observation_digest":"sha256:190ee5c0cdbe3d2a693bcb73a3fef6182cce679b65b0d33dd9a4bf3b90767ddf","observation_id":"fd963db7-8803-49aa-b137-ec61ab57d8d8","resolution":{"observed_at":"2026-08-01T23:50:15.667569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14714","snapshot_observed_at":"2026-08-05T00:38:52.747980Z","title":"Efficient and effective vocabulary expansion towards multilingual large language models.arXiv preprint arXiv:2402.14714,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.00582","last_updated":"2026-08-01T10:38:23Z","snapshot_observed_at":"2026-08-18T18:55:05.873170Z","submitted_at":"2026-08-01T10:38:23Z","title":"Writing-System-Level Tokenizer Adaptation for Byte-Level BPE","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T00:38:52.747980Z"},"links":{"cited_paper":"/paper/2402.14714","citing_paper":"/paper/2608.00582"},"observation_digest":"sha256:b685ac00573eabee7b7a8476049e627bd97400fffe24c9e8ce3c81d4ce0de627","observation_id":"4e23a61c-41f1-497e-8f93-3813d8a0c691","resolution":{"observed_at":"2026-08-05T00:38:52.747980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2402.14714/citation-record","integrity":"/paper/2402.14714/integrity","json":"/paper/2402.14714/citation-record.json","paper":"/paper/2402.14714"},"outbound":[],"paper":{"arxiv_id":"2402.14714","last_updated":"2024-02-22T17:12:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T14:16:10.135909Z","submitted_at":"2024-02-22T17:12:39Z","title":"Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2402.14714."}