{"as_of":"2026-08-07T17:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0376bdf27614534ea93b67075b525ee2419ffcac41df447dcb0140455a033d19","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:58:14.970827Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:58:06.361703Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-25T05:15:22.246413Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06607","snapshot_observed_at":"2026-08-02T22:58:06.361703Z","title":"Training-free tokenizer transplantation via orthogonal matching pursuit","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.15382","last_updated":"2026-05-28T08:46:27Z","snapshot_observed_at":"2026-08-03T23:19:36.572742Z","submitted_at":"2026-02-17T06:31:53Z","title":"The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T22:58:06.361703Z"},"links":{"cited_paper":"/paper/2506.06607","citing_paper":"/paper/2602.15382"},"observation_digest":"sha256:a212833f722a20717e248c363f1ad691fa8b07efd5abd5adab8d37ee6638f242","observation_id":"58516bb2-ef18-4698-9005-a2189dbd1a73","resolution":{"observed_at":"2026-08-02T22:58:06.361703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"cited_work":{"arxiv_id":"2506.06607","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.06607","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Training-free tokenizer transplantation via orthogonal matching pursuit","venue":null,"work_id":"535c37bf-256d-43dc-a51e-9fc99f0ded09","year":2025},"citing_paper":{"arxiv_id":"2605.23645","last_updated":"2026-05-22T13:59:13Z","snapshot_observed_at":"2026-08-02T16:05:46.812556Z","submitted_at":"2026-05-22T13:59:13Z","title":"Learning Through Noise: Why Subliminal Learning Works and When It Fails","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-25T05:14:46.278482Z"},"links":{"cited_paper":"/paper/2506.06607","citing_paper":"/paper/2605.23645"},"observation_digest":"sha256:c98a2d47a45955d8fc4a5be4d165d91b01c3cfbd28d9adb97c067c753d6a3262","observation_id":"61c90512-3b4d-44ec-83aa-a3edb2437f03","resolution":{"observed_at":"2026-05-25T05:15:22.248856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06607","snapshot_observed_at":"2026-08-01T23:50:15.197912Z","title":"Charles Goddard and Fernando Fernandes Neto","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15232","last_updated":"2026-07-16T17:32:38Z","snapshot_observed_at":"2026-08-05T12:26:35.447590Z","submitted_at":"2026-07-16T17:32:38Z","title":"In-Place Tokenizer Expansion for Pre-trained LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T23:50:15.197912Z"},"links":{"cited_paper":"/paper/2506.06607","citing_paper":"/paper/2607.15232"},"observation_digest":"sha256:9dd09d5e98116ecfe7affb838039bebdbf501af4465402d051730f6549acbacc","observation_id":"0900b006-84b7-4846-a024-4497586a2d37","resolution":{"observed_at":"2026-08-01T23:50:15.197912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.06607/citation-record","integrity":"/paper/2506.06607/integrity","json":"/paper/2506.06607/citation-record.json","paper":"/paper/2506.06607"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.05109","last_updated":"2024-10-07T16:21:29Z","snapshot_observed_at":"2026-08-03T23:07:15.667650Z","submitted_at":"2024-02-07T18:58:50Z","title":"Hydra: Sequentially-Dependent Draft Heads for Medusa Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05109","snapshot_observed_at":"2026-08-07T05:58:14.817137Z","title":"Hydra: Sequentially-dependent draft heads for medusa decoding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.817137Z"},"links":{"cited_paper":"/paper/2402.05109","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:acee2a2b55e313d7a2dba32ca2b773afc011e340d69ef4532a55c9861930f5df","observation_id":"928c284b-91da-460b-b551-475d37b43ba8","resolution":{"observed_at":"2026-08-07T05:58:14.817137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.822539Z","title":"On the cross-lingual transferability of monolingual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.822539Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:a65c55ca66f0c0a8c2afeebb4b571302c6ba2864999efb37642dd1d9afb588b0","observation_id":"033c0afc-f711-4761-a88a-fb940e2fc4d8","resolution":{"observed_at":"2026-08-07T05:58:14.822539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12030","last_updated":"2025-01-27T10:02:44Z","snapshot_observed_at":"2026-07-06T17:32:06.610773Z","submitted_at":"2024-02-19T10:37:29Z","title":"Towards Cross-Tokenizer Distillation: the Universal Logit Distillation Loss for LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12030","snapshot_observed_at":"2026-08-07T05:58:14.827341Z","title":"Towards cross-tokenizer distillation: the universal logit distillation loss for llms.arXiv preprint arXiv:2402.12030 , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.827341Z"},"links":{"cited_paper":"/paper/2402.12030","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:d3212bb050816962b47a06383fb7e93ceb361db2cb3f9999b20e82f4f5096b3d","observation_id":"50bed358-f5b1-4353-81a8-e557d93e5f8b","resolution":{"observed_at":"2026-08-07T05:58:14.827341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.832160Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.832160Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:5930214dfffaee834cdc6ab5bc9884a713d4c90034122e56b6deb47cee2d8386","observation_id":"68dff718-b5e4-4bf2-8118-67ccab72fa80","resolution":{"observed_at":"2026-08-07T05:58:14.832160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T05:58:14.836913Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.836913Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:5c31a987742384d0bb7c6910cc7bb4924b4e83dd3ef87f068afb555466bdb6a6","observation_id":"e93cd026-41ca-47f7-ac29-7e11ab7c0c50","resolution":{"observed_at":"2026-08-07T05:58:14.836913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T05:58:14.841736Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168 , 2021","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.841736Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:c74fed5d8e69c2faacd18838241a6771b593d877bb968aedc586e320d0929c14","observation_id":"1adc318c-a0b6-41b8-9e73-9f7171bec2d5","resolution":{"observed_at":"2026-08-07T05:58:14.841736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1710.04087","last_updated":"2018-01-30T14:41:51Z","snapshot_observed_at":"2026-07-06T06:03:43.625152Z","submitted_at":"2017-10-11T14:24:28Z","title":"Word Translation Without Parallel Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.04087","snapshot_observed_at":"2026-08-07T05:58:14.846758Z","title":"Word translation without parallel data, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.846758Z"},"links":{"cited_paper":"/paper/1710.04087","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:2ed54a704b4142f9ad50724989f38972ba7fd18b994ec6c88b957634145c9dbd","observation_id":"002667a8-3069-4df8-858b-b7b9ce5119b2","resolution":{"observed_at":"2026-08-07T05:58:14.846758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.05053","last_updated":"2018-09-13T16:39:53Z","snapshot_observed_at":"2026-07-06T07:02:02.624968Z","submitted_at":"2018-09-13T16:39:53Z","title":"XNLI: Evaluating Cross-lingual Sentence Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.05053","snapshot_observed_at":"2026-08-07T05:58:14.851742Z","title":"Xnli: Evaluating cross-lingual sentence representations.arXiv preprint arXiv:1809.05053, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.851742Z"},"links":{"cited_paper":"/paper/1809.05053","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:739e32e80cec3eb8610d1423181acad4b9261a4deda8e08a2eb40740b1982835","observation_id":"8f7b7152-30c4-4cf0-b72d-9fdba98d6791","resolution":{"observed_at":"2026-08-07T05:58:14.851742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.856183Z","title":"FOCUS: Effective embedding initialization for mono- lingual specialization of multilingual models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.856183Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:04f2bbf6b8b32b522e8b13d9a24448e7b87a035b675e3dc0b059381f1c88681d","observation_id":"d692f897-be79-4db0-b2f0-5e665678b35b","resolution":{"observed_at":"2026-08-07T05:58:14.856183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.860161Z","title":"How contextual are contextualized word representations? Comparing the geometry of BERT, ELMo, and GPT-2 embeddings","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.860161Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:cee92595f9366b57d84fc17869d10037080e93169c8857ec87b2d656b49f0561","observation_id":"058c2288-36ac-4d8c-b7e3-4b2add9d4930","resolution":{"observed_at":"2026-08-07T05:58:14.860161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.864207Z","title":"A framework for few-shot language model evaluation, 12 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.864207Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:316e63347671cd8fd306f230c5ed2f83332cfa6428a3c3d408de4fe43c0fa5f4","observation_id":"83f94599-70c4-4768-ae1c-fd9dd898640d","resolution":{"observed_at":"2026-08-07T05:58:14.864207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.868026Z","title":"Fast vocabulary transfer for language model compression","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.868026Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:b0a7b3bce9cf92d3ae811b9d6e0268fb1a1cf7952a55118de5392184d5f573b7","observation_id":"eb999d92-3e15-4585-ba1e-728153a430bb","resolution":{"observed_at":"2026-08-07T05:58:14.868026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.872179Z","title":"Arcee‘s MergeKit: A toolkit for merg- ing large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.872179Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:069d31a074e35191e028fdfcf16aadd5096fcd811166982d65f238cab393f476","observation_id":"85ef42d2-9731-4b2d-b562-0920a58f24cf","resolution":{"observed_at":"2026-08-07T05:58:14.872179Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:58:14.876220Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783 , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.876220Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:27343817a3357168f6cc51340610a266169eaf586ef87a184535bf6011db99a7","observation_id":"9be117e3-aefd-490f-9b12-2d12162d9d26","resolution":{"observed_at":"2026-08-07T05:58:14.876220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T05:58:14.880047Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.880047Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:6ef254fb20d8300798e7d3268d8bbe46e294bd7bbcb0a399359cc82268ef54cc","observation_id":"0cacedb0-36f1-44c5-83d8-e8bb3bf565cc","resolution":{"observed_at":"2026-08-07T05:58:14.880047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.712674Z","title":"Initializing new word embeddings for pretrained language models, 2021","venue":null,"work_id":"935b34d3-22ac-4c07-897a-d37bd971e619","year":2021},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.884285Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:9c573eeb2643e2767b41bf54b9ec29b2360deb17790550999c2e6c5433c61766","observation_id":"69ea6c8f-7257-487d-aee5-9839d19ade88","resolution":{"observed_at":"2026-08-07T05:58:15.717650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-07-06T04:11:24.157003Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-07T05:58:14.890598Z","title":"Distilling the knowledge in a neural network","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.890598Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:2a2ba6ccbfbf4e0fb8b8dcfe3b5b98267bdb3771f052a55e38fad36ad302167a","observation_id":"b2b38b97-6d5b-467f-9704-8ad54edbe3a0","resolution":{"observed_at":"2026-08-07T05:58:14.890598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.698727Z","title":"Vocab transplantation tool (github repository), 2025","venue":null,"work_id":"239ad88c-7609-4ea7-b648-e78a388ada7e","year":2025},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.894720Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:0f8d4be25c70c4a1a27f2785298a9fb8308349e60268e5d24b33afb5e98b24a7","observation_id":"b785e3ba-54eb-4948-92ed-72bfb5a036c4","resolution":{"observed_at":"2026-08-07T05:58:15.702868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00873","last_updated":"2025-02-02T18:55:26Z","snapshot_observed_at":"2026-08-04T21:15:40.586849Z","submitted_at":"2025-02-02T18:55:26Z","title":"Language Models Use Trigonometry to Do Addition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00873","snapshot_observed_at":"2026-08-07T05:58:14.898944Z","title":"Language models use trigonometry to do addition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.898944Z"},"links":{"cited_paper":"/paper/2502.00873","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:ae290422c9b69b5a4002f1b9fe232316e4f2b1e5ebd67955328ed1a39772e7fa","observation_id":"96148bfd-984b-4198-a023-be104c764a7c","resolution":{"observed_at":"2026-08-07T05:58:14.898944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.684641Z","title":"Cross-lingual alignment methods for multilingual BERT: A comparative study","venue":null,"work_id":"e17f4bb7-98cb-4d61-b64a-763596cb6acb","year":2020},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.903037Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:5f578dc87a772a1c62401e5a9547a7da5d3865159cf47d235791521a3e9a7ed9","observation_id":"e52b866a-3340-47cb-a1eb-06b9cf21705a","resolution":{"observed_at":"2026-08-07T05:58:15.689266Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.21073","last_updated":"2025-07-15T12:15:41Z","snapshot_observed_at":"2026-08-07T16:34:05.897540Z","submitted_at":"2025-03-27T01:17:06Z","title":"Shared Global and Local Geometry of Language Model Embeddings","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.21073","snapshot_observed_at":"2026-08-07T05:58:14.907095Z","title":"Shared global and local geometry of language model embeddings, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.907095Z"},"links":{"cited_paper":"/paper/2503.21073","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:11aabcba4afdbd9179da5528269529cf854582727fe9937440c725ba4400710e","observation_id":"bbe0ba58-9f38-4d09-804c-726e2b9f7f3b","resolution":{"observed_at":"2026-08-07T05:58:14.907095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.668108Z","title":"Fast inference from transformers via speculative decoding","venue":null,"work_id":"20f67453-d3bc-47a7-9bed-fe9a5ded2a5a","year":2023},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.911404Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:cf78de7a498b8c7c5381ee4b2ea0df97b736ba246553e3348fb26987f521aaea","observation_id":"6260b57f-4983-4764-96fc-d944206bb7f9","resolution":{"observed_at":"2026-08-07T05:58:15.673296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11794","last_updated":"2025-04-21T17:48:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-17T17:42:57Z","title":"DataComp-LM: In search of the next generation of training sets for language models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11794","snapshot_observed_at":"2026-08-07T05:58:14.915529Z","title":"Dimakis, Yair Carmon, Achal Dave, Ludwig Schmidt, and Vaishaal Shankar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.915529Z"},"links":{"cited_paper":"/paper/2406.11794","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:170dc94d188922b51809655baf8721e882db085a581eba636fbfa46ade99ef7a","observation_id":"11436aa8-83ae-40c2-b9d5-6952b54001ff","resolution":{"observed_at":"2026-08-07T05:58:14.915529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2016.77322","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.298456Z","title":null,"venue":null,"work_id":"685d5673-ae49-4c3e-bb30-454c75b39313","year":2016},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.919909Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:4af43867dd7312742f9060e463530d1f78914967bee106d9133d582d12759494","observation_id":"9a3283ac-d4c3-4173-a85f-74defbd3e452","resolution":{"observed_at":"2026-08-07T05:58:15.306270Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-07T05:58:14.924229Z","title":"Efficient estimation of word representations in vector space.arXiv preprint arXiv:1301.3781 , 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.924229Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:8d752e1e9caec7d0367fc0dafab5d8355a01df22b588b4f034c3403f7e813f1d","observation_id":"53fa2ef2-a747-4dc7-8151-ce117eb72c78","resolution":{"observed_at":"2026-08-07T05:58:14.924229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.652881Z","title":"WECHSEL: Effective initialization of subword embeddings for cross-lingual transfer of monolingual language models","venue":null,"work_id":"83a215c3-e5c3-4bcf-854d-74eed812bac2","year":2022},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.928584Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:ae5bc1827bc76572316c30fdf00563b25536cf664f8e615b0ae60ba8bd9a54e1","observation_id":"eaeed1c2-c554-4b1b-9e84-03f3fc41b516","resolution":{"observed_at":"2026-08-07T05:58:15.657431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.936655Z","title":"Zero-shot tokenizer transfer, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.936655Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:c564005bcfb15456f2cac9fe2c385b4d611e5395c31544819d3f0304b4ac4491","observation_id":"3b6c7dec-344c-44f5-b291-015cdaace40d","resolution":{"observed_at":"2026-08-07T05:58:14.936655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.620780Z","title":"Efficient language model training through cross-lingual and progressive transfer learning, 2023","venue":null,"work_id":"4dfbfd82-4daa-4019-90b6-79c402196c2a","year":2023},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.942054Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:107227967a2e8e71a46c30e3152c415ff58fce8992ea4477e6c0a6ce5b243c46","observation_id":"1529d395-7d0f-43e9-bd9d-e4eeec4dfc35","resolution":{"observed_at":"2026-08-07T05:58:15.625219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.06031","last_updated":"2016-06-20T09:37:17Z","snapshot_observed_at":"2026-08-05T16:27:22.031013Z","submitted_at":"2016-06-20T09:37:17Z","title":"The LAMBADA dataset: Word prediction requiring a broad discourse context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.06031","snapshot_observed_at":"2026-08-07T05:58:14.946324Z","title":"The lambada dataset: Word prediction requiring a broad discourse context.arXiv preprint arXiv:1606.06031 , 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.946324Z"},"links":{"cited_paper":"/paper/1606.06031","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:8e23c0e94990b08ab81bdadcfc5a595ad681b6ca4f40f463f4db22e1a0a6be4c","observation_id":"61cd0f0b-9d1a-43b2-809c-d7615ae6066d","resolution":{"observed_at":"2026-08-07T05:58:14.946324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.606614Z","title":"Orthogonal matching pursuit: Recursive function approximation with applications to wavelet decomposition","venue":null,"work_id":"d59d24ac-bbc0-4d95-b770-1cc0bf61a5a3","year":1993},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.950608Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:c7cec34d30eee580bdbe38aa2b67a7e53cd3ed66b57c70066ea502c1a15a0912","observation_id":"57eae1a3-9eb2-447d-af4c-fa6fa9fb8f69","resolution":{"observed_at":"2026-08-07T05:58:15.610757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:14.954395Z","title":"How good is your tokenizer? on the monolingual performance of multilingual language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.954395Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:f024765f96595f379764d46b2d7287be1707bd28f3c8db2c8b7f143725bbf65b","observation_id":"0eb52d75-ae71-4767-8486-2168da6bdc65","resolution":{"observed_at":"2026-08-07T05:58:14.954395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.04715","last_updated":"2018-10-09T11:54:10Z","snapshot_observed_at":"2026-07-06T06:49:53.002704Z","submitted_at":"2018-07-12T16:43:32Z","title":"Orthogonal Matching Pursuit for Text Classification","version":2},"cited_work":{"arxiv_id":"1807.04715","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.04715","snapshot_observed_at":"2026-08-07T05:58:15.121846Z","title":"Orthogonal Matching Pursuit for Text Classification","venue":"cs.LG","work_id":"c301e2e1-6b5f-49bd-be05-87c595df7768","year":2018},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.958446Z"},"links":{"cited_paper":"/paper/1807.04715","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:4bcbdf310dc65b8082e2b18ee7cfa5de35a92b0d1b7bd66861a095f7805bbea7","observation_id":"d71f6a70-baa0-4f9d-8445-9fb3ad3c5e84","resolution":{"observed_at":"2026-08-07T05:58:15.128555Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.592124Z","title":"Signal recovery from random measurements via orthogonal matching pursuit","venue":null,"work_id":"bb25fd4d-d886-487b-8b78-923b6270a2fc","year":2007},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.962653Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:4857fef374424bc6edf8ddafac5d968440a4761d6d8db9ea31991a512922bd05","observation_id":"06604c09-5ca9-4f70-8e1f-590a9c0ddda8","resolution":{"observed_at":"2026-08-07T05:58:15.596607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T05:58:14.966911Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.966911Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:e1c65bec87d98ce648633b03b6e12a4fb56cbfa3fdac5ee85efc066a6a9a8497","observation_id":"f2a9598e-a5eb-4c34-ae0d-30251d72e3e0","resolution":{"observed_at":"2026-08-07T05:58:14.966911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.11828","last_updated":"2019-08-30T16:40:00Z","snapshot_observed_at":"2026-08-07T17:08:49.832011Z","submitted_at":"2019-08-30T16:40:00Z","title":"PAWS-X: A Cross-lingual Adversarial Dataset for Paraphrase Identification","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.11828","snapshot_observed_at":"2026-08-07T05:58:14.970827Z","title":"Paws-x: A cross-lingual adversarial dataset for paraphrase identification.arXiv preprint arXiv:1908.11828 , 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.970827Z"},"links":{"cited_paper":"/paper/1908.11828","citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:cd7c9f9d577d6fcdf9a42b055633e16651fbb873227921ed1ae165e76d1c6a2f","observation_id":"f3764f64-deaa-4e5a-a5bb-1a0ab93fe44e","resolution":{"observed_at":"2026-08-07T05:58:14.970827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:58:15.635178Z","title":"URL https://aclanthology.org/2022","venue":null,"work_id":"d7c5863f-6018-490c-8957-3763c6cc7452","year":2022},"citing_paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T05:58:14.932518Z"},"links":{"citing_paper":"/paper/2506.06607"},"observation_digest":"sha256:d0a9ed8e1776ad78a234f83c638e523d4e4a3db013b3a7115d4078d608c4d88e","observation_id":"810672fb-cb8b-4582-bb14-11b6cb802f4b","resolution":{"observed_at":"2026-08-07T05:58:15.639441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.06607","last_updated":"2025-06-07T00:51:27Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:51:05.729801Z","submitted_at":"2025-06-07T00:51:27Z","title":"Training-Free Tokenizer Transplantation via Orthogonal Matching Pursuit"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":9},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 3 inbound Pith citation observations for arXiv:2506.06607."}