{"as_of":"2026-08-08T12:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f3d737c4381137b034cb064e86585585e6b2d9bbce6977acd52077a681e4830","coverage":[{"denominator":78,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":78,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:06:28.332063Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T22:58:07.981453Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T08:36:16.962123Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03523","snapshot_observed_at":"2026-08-02T22:58:07.981453Z","title":"Tokalign: Efficient vocabulary adaptation via token alignment","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.15382","last_updated":"2026-05-28T08:46:27Z","snapshot_observed_at":"2026-08-03T23:19:36.572742Z","submitted_at":"2026-02-17T06:31:53Z","title":"The Vision Wormhole: Latent-Space Communication in Heterogeneous Multi-Agent Systems","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T22:58:07.981453Z"},"links":{"cited_paper":"/paper/2506.03523","citing_paper":"/paper/2602.15382"},"observation_digest":"sha256:cb7073697bad45548bcafb2ccdf2dc34ff9c3dfe3002f86a9ce3c50177f531f5","observation_id":"e4dda67d-1039-4a4b-8583-85c4ee2c1aeb","resolution":{"observed_at":"2026-08-02T22:58:07.981453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"cited_work":{"arxiv_id":"2506.03523","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03523","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"TokAlign : Efficient vocabulary adaptation via token alignment","venue":null,"work_id":"b8e2648f-eeb1-4b45-8266-5700f55cc39f","year":2025},"citing_paper":{"arxiv_id":"2605.22005","last_updated":"2026-05-21T05:02:51Z","snapshot_observed_at":"2026-08-04T14:57:02.121312Z","submitted_at":"2026-05-21T05:02:51Z","title":"Check Your LLM's Secret Dictionary! Five Lines of Code Reveal What Your LLM Learned (Including What It Shouldn't Have)","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-22T08:35:02.870481Z"},"links":{"cited_paper":"/paper/2506.03523","citing_paper":"/paper/2605.22005"},"observation_digest":"sha256:adea88bbd57cbb00cd5ab3cd1239608a74d0e010772fae8c2067523ceecb7d77","observation_id":"421e5d99-9b60-40f8-9698-d85fe3bc8e85","resolution":{"observed_at":"2026-05-22T08:36:16.965373Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03523","snapshot_observed_at":"2026-08-01T23:50:15.766936Z","title":"arXiv:2506.03523","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15232","last_updated":"2026-07-16T17:32:38Z","snapshot_observed_at":"2026-08-08T07:20:48.656314Z","submitted_at":"2026-07-16T17:32:38Z","title":"In-Place Tokenizer Expansion for Pre-trained LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T23:50:15.766936Z"},"links":{"cited_paper":"/paper/2506.03523","citing_paper":"/paper/2607.15232"},"observation_digest":"sha256:a8ce0162a33498fafe4a6973e6b29da2960a5ce92bafd04a8693e3f98b75b044","observation_id":"c3e2d6db-0ba2-426c-8812-52262f7417e0","resolution":{"observed_at":"2026-08-01T23:50:15.766936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03523/citation-record","integrity":"/paper/2506.03523/integrity","json":"/paper/2506.03523/citation-record.json","paper":"/paper/2506.03523"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.516974Z","title":"Jiang, Jia Deng, Stella Biderman, and Sean Welleck","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.516974Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:0a58e2ee25cb252cdd188018dd964bd0f075353cb199f63e85dac2276fbb91dd","observation_id":"773716cd-bf3d-4b35-b025-58ee55a7c682","resolution":{"observed_at":"2026-08-07T11:06:27.516974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.525011Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.525011Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:a3ade7678760479f949002a968ce800908838097d50001b31b741b15b85fcce6","observation_id":"7814e118-eeb4-48fb-a451-69ac8fa54558","resolution":{"observed_at":"2026-08-07T11:06:27.525011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.586187Z","title":null,"venue":null,"work_id":"06ab320a-53ed-434d-83bf-04d100eb8682","year":2003},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.539466Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:8a04730feb556b7628f6944f294f5b326786cc3c1f0763063dfdff329f7a2112","observation_id":"4a134a6a-641f-47be-aa19-7e8503fa5dda","resolution":{"observed_at":"2026-08-07T11:06:30.593569Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.546148Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.546148Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:c548a7c225a66447059c44d1d4536bce5a07027e2ab6dc37bb6ccd2443a4da75","observation_id":"3cd710d3-f349-4b7e-bb21-3b428ad4d566","resolution":{"observed_at":"2026-08-07T11:06:27.546148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.552043Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.552043Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:983da2357219ada526ce42eb519e7fc1cebc7bf3c75d5624a350d542a00bd7e6","observation_id":"e9915c34-3a0b-47ef-b849-cd40e8ffbb9e","resolution":{"observed_at":"2026-08-07T11:06:27.552043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.04606","last_updated":"2017-06-19T17:41:07Z","snapshot_observed_at":"2026-07-06T05:03:45.255477Z","submitted_at":"2016-07-15T18:27:55Z","title":"Enriching Word Vectors with Subword Information","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.04606","snapshot_observed_at":"2026-08-07T11:06:27.558899Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.558899Z"},"links":{"cited_paper":"/paper/1607.04606","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3a85974de02e77c4bb1ffcfe513330ec8793366072be8a7acd72a2db78f864ec","observation_id":"1b1281d5-bde0-4a17-8a22-b9a5d704ca49","resolution":{"observed_at":"2026-08-07T11:06:27.558899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.567256Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.567256Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:45c854d3d30d06cd87b555705c4d4f58d9b615fc06ebf8a969983e9e265274c6","observation_id":"448dfec4-1da7-473e-b6b0-e3aa56d60c4e","resolution":{"observed_at":"2026-08-07T11:06:27.567256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.575761Z","title":"Chau, Lucy H","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.575761Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:65e006618d06ca7484f65330a192549a6dbdc0bb1819968ea7b9c9bd34ee0741","observation_id":"cd6db50f-6cfe-4299-8af9-0160462b76a4","resolution":{"observed_at":"2026-08-07T11:06:27.575761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.3555","last_updated":"2014-12-11T06:46:53Z","snapshot_observed_at":"2026-08-03T11:40:51.182181Z","submitted_at":"2014-12-11T06:46:53Z","title":"Empirical Evaluation of Gated Recurrent Neural Networks on Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.3555","snapshot_observed_at":"2026-08-07T11:06:27.582703Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.582703Z"},"links":{"cited_paper":"/paper/1412.3555","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:ada2dc50c93185fa1eeb64722b8d32feb9b86913ea4586de23dbfc3a18605746","observation_id":"18fa7bd1-754f-46b6-8aaa-38e2878b9f4b","resolution":{"observed_at":"2026-08-07T11:06:27.582703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.588168Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.588168Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:2bec0a4a84f072d3ec2596dacd3babc8586bdf718bebf22663a1c3d135cfa56c","observation_id":"29649798-f8de-4ef8-a86f-534243627d74","resolution":{"observed_at":"2026-08-07T11:06:27.588168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-07T11:06:27.795046Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.795046Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:653ff6571a3a220130d8c8ddcb9261fc6efb0da9ded4a4800965ac96ce5fc85b","observation_id":"a1607f32-9a08-4652-a796-75a653cabd10","resolution":{"observed_at":"2026-08-07T11:06:27.795046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.802700Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.802700Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:065deed8cc5bcecfc41eaeb9edd7851e64140fe964925021509980ac298ac696","observation_id":"1e33a68e-b137-4142-ace1-7cc4352bdbe0","resolution":{"observed_at":"2026-08-07T11:06:27.802700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.809158Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.809158Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:51fb0a38e90ff33fd2fb53fe3e938257032b8910618fc3fded47a9a2d1c98648","observation_id":"0260af9c-9f69-43ec-ac70-18fb72e7ee8a","resolution":{"observed_at":"2026-08-07T11:06:27.809158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.818436Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.818436Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:c889484639a27c1125396ca62a5d6ad889556ef070c6b5a2ed6fbaf7e6e395d9","observation_id":"0afcd93f-b5a9-4701-94ed-a5c792496bde","resolution":{"observed_at":"2026-08-07T11:06:27.818436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.823923Z","title":"Downey, Terra Blevins, Nora Goldfine, and Shane Steinert-Threlkeld","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.823923Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:ef779ad211a4579d38adf178c8f38ef776f519e316a5c3c0d7d5467a798281c2","observation_id":"85028644-7d77-4ccb-81fb-4136d2478bb1","resolution":{"observed_at":"2026-08-07T11:06:27.823923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-07T11:06:27.832070Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.832070Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:e01b0d4cf115b1fe993fea0454bc12f9d87c24c0188168e5cbca3df305f020f0","observation_id":"a67946bf-098c-4980-acf1-f516385e491c","resolution":{"observed_at":"2026-08-07T11:06:27.832070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.839741Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.839741Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:7bde83584c8adfa3ec6eb9289c459a1e161eb0a1a54041c7cf1273f5698f4520","observation_id":"4ad0b997-5e3f-4e78-8366-a66039272e87","resolution":{"observed_at":"2026-08-07T11:06:27.839741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12793","last_updated":"2024-07-30T03:58:11Z","snapshot_observed_at":"2026-08-07T13:56:34.167869Z","submitted_at":"2024-06-18T16:58:21Z","title":"ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12793","snapshot_observed_at":"2026-08-07T11:06:27.846951Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.846951Z"},"links":{"cited_paper":"/paper/2406.12793","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:1d6cff281ef98ee92dd603cf21b8ab875b4918fdc1f4f8b7c5bf5c0bdddb9495","observation_id":"4eb3d6e8-6ea6-41c2-b70e-a541b0f9ab32","resolution":{"observed_at":"2026-08-07T11:06:27.846951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16607","last_updated":"2024-11-30T19:31:38Z","snapshot_observed_at":"2026-08-06T17:20:45.836739Z","submitted_at":"2024-07-23T16:13:22Z","title":"Data Mixture Inference: What do BPE Tokenizers Reveal about their Training Data?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16607","snapshot_observed_at":"2026-08-07T11:06:27.856130Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.856130Z"},"links":{"cited_paper":"/paper/2407.16607","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:ff3f7858e92e62f3f3acd6bccba74a56c8e2f17c2e6ce134acc909f71463cd51","observation_id":"9df92565-2a41-47f7-bcb1-195a6c33393d","resolution":{"observed_at":"2026-08-07T11:06:27.856130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.866833Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.866833Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:c6bc86ba147d04e8986403f1de0178287c419ee6a33e325923958318d760d2c0","observation_id":"209719c1-0bb7-4a36-baf7-8129bc3369bb","resolution":{"observed_at":"2026-08-07T11:06:27.866833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-07T11:06:27.876641Z","title":"Rae, Oriol Vinyals, and Laurent Sifre","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.876641Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:0a41566d1cc243edd773f3cc223f7c00dff5ffda2e8c3e3b91ddb984dba86ab7","observation_id":"2d17fa1f-5c5d-4c3f-a66c-a873d81156b7","resolution":{"observed_at":"2026-08-07T11:06:27.876641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T11:06:27.882403Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.882403Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:f285ac3b51ff34ded66c09f5b11d6cefc5f4388005b1625b2373bdb506b62aca","observation_id":"6b4da175-1596-4cb8-8ba8-c6704a5d834d","resolution":{"observed_at":"2026-08-07T11:06:27.882403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T11:06:27.888949Z","title":"Brown, Benjamin Chess, Rewon Child, Scott Gray, Alec Radford, Jeffrey Wu, and Dario Amodei","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.888949Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:dace9e86ea6dab298c39f8f93323dd634d37c094ae7b3ee9e49c92244c2e8e40","observation_id":"5a69d92d-ee29-43d5-9e55-2a920f13ee4d","resolution":{"observed_at":"2026-08-07T11:06:27.888949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.893779Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.893779Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:41998271a53557541972644cf250a6b0cc620fd5ad6f6e1bdf08d113dc412a77","observation_id":"bdd11817-c892-41d0-be0a-2ecebb26dbda","resolution":{"observed_at":"2026-08-07T11:06:27.893779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.463073Z","title":null,"venue":null,"work_id":"9058ea76-e2a7-4d05-a8fd-f1395465a2a1","year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.899078Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:17dbcfe41bca28ca3b49dc2a7bb3e3bbeb856227697394b95e4ae09b45a955ca","observation_id":"ebd6d28b-8a9e-4d90-88f9-9952829f4190","resolution":{"observed_at":"2026-08-07T11:06:30.470070Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.906007Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.906007Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:5cdd12dbfec021e83ef4cdc4378747b8c2acb43e761542d94e126d289f5fbae2","observation_id":"0071a950-4a8a-452c-9413-8515f41a811b","resolution":{"observed_at":"2026-08-07T11:06:27.906007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.912723Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.912723Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:60cb6c43213ae3daee466a2e8f58f01059e39d2343abb7768f89810eaed01d1b","observation_id":"dcfb9a23-dd7c-4a9f-96ca-1fcd9a787141","resolution":{"observed_at":"2026-08-07T11:06:27.912723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.919075Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.919075Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:96febdab099d6081c1a1685781f11b48feaae735934502f07701941f6e9ea47e","observation_id":"ecd05808-f336-4988-9c57-a62fe9cc8f61","resolution":{"observed_at":"2026-08-07T11:06:27.919075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.427634Z","title":null,"venue":null,"work_id":"eff051db-5615-4888-868b-95a7f434089c","year":2017},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.924122Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3eafaa85a91c6603f8faac5817296662673ebb2af3a92af8f722c0a786b2bd59","observation_id":"e6b2cbef-246b-4944-b491-4cb89bdc21ed","resolution":{"observed_at":"2026-08-07T11:06:30.433870Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.928698Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.928698Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:0b7dbc1e69e55e6e39c3e0f4f8f3532bb118b683d25e2e51ad133f6d27956313","observation_id":"125dd11c-a1fd-4df3-8e5e-93a7ea96f7b8","resolution":{"observed_at":"2026-08-07T11:06:27.928698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.937667Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.937667Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:31ed1c6ac0f7f2de18a867d5d7d3c716e66a51988202eec84b3d45f8d4cd3430","observation_id":"962e471c-fd21-47b9-97d8-024312e06b88","resolution":{"observed_at":"2026-08-07T11:06:27.937667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.944019Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.944019Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:ecba277eed75bd62baa9b62931e446b5a1c8d3da3fa4a4a55430ddb8cf7225fb","observation_id":"b0a3ca72-7be9-4b62-8942-ea888715d7da","resolution":{"observed_at":"2026-08-07T11:06:27.944019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.06089","last_updated":"2024-07-08T16:29:08Z","snapshot_observed_at":"2026-08-06T09:58:33.079020Z","submitted_at":"2024-07-08T16:29:08Z","title":"Merge, Ensemble, and Cooperate! A Survey on Collaborative Strategies in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.06089","snapshot_observed_at":"2026-08-07T11:06:27.948757Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.948757Z"},"links":{"cited_paper":"/paper/2407.06089","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3e10eef79e3a5a2c4fd2a8752d302a5093416756d641d43d28a6613f9ea12b63","observation_id":"f49c2d29-a062-4047-af6a-41442b8866ac","resolution":{"observed_at":"2026-08-07T11:06:27.948757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.367311Z","title":null,"venue":null,"work_id":"27dd7cda-36f3-4820-adbe-cbfd72f76475","year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.958004Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:6e810d9f593343e5cfaeca13e23f2cea891b7bed19b2ebd1ae0471a79951663d","observation_id":"a1f0381b-d3de-4c6e-b74f-7b2c8e3fa9cf","resolution":{"observed_at":"2026-08-07T11:06:30.376214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.970462Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.970462Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:b10cb8dfbcb5271c0716e4c6e8ab24d0efe9cabb5223ad397b5a183080488e56","observation_id":"6c829665-dfbd-4ce5-a5ba-2aeae68bdbd6","resolution":{"observed_at":"2026-08-07T11:06:27.970462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:27.984356Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.984356Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:7734bb553a66e00f81239da29a9861cf18a9d620fdc4033f340bd18bd89e493a","observation_id":"b0fa307d-92ca-493b-9a80-7bf1ad79f1c5","resolution":{"observed_at":"2026-08-07T11:06:27.984356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1301.3781","last_updated":"2013-09-07T00:30:40Z","snapshot_observed_at":"2026-07-06T03:04:11.148340Z","submitted_at":"2013-01-16T18:24:43Z","title":"Efficient Estimation of Word Representations in Vector Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1301.3781","snapshot_observed_at":"2026-08-07T11:06:27.990809Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.990809Z"},"links":{"cited_paper":"/paper/1301.3781","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:e4a79da4a7252e824eabcba56c63d70e7ccf8906c8d5980be400cdccf4a48a37","observation_id":"cbf01ff5-38ca-4006-a75b-7006b60d428e","resolution":{"observed_at":"2026-08-07T11:06:27.990809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1310.4546","last_updated":"2013-10-16T23:28:53Z","snapshot_observed_at":"2026-07-06T03:25:47.809707Z","submitted_at":"2013-10-16T23:28:53Z","title":"Distributed Representations of Words and Phrases and their Compositionality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1310.4546","snapshot_observed_at":"2026-08-07T11:06:27.998195Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:27.998195Z"},"links":{"cited_paper":"/paper/1310.4546","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:2d30037fb868f4f6122959807d9f8ca80fa9af5ca38e162facfd75721212b9b5","observation_id":"550f997a-b4a5-4da4-8230-29896a2ebb68","resolution":{"observed_at":"2026-08-07T11:06:27.998195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.004225Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.004225Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:03cbe868943dc424ac4944e38d98a6c30d2617d382816f2337e5c63fb8b2f78d","observation_id":"1838336f-d053-439b-853a-b6a3f30d208b","resolution":{"observed_at":"2026-08-07T11:06:28.004225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.009815Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.009815Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:712d6b7caacec6b0a08f40fa64e0df11abb67a2851444e38606ac88f1d687d76","observation_id":"8a8f6d9c-7fa8-4c1c-937f-3b27905f33e1","resolution":{"observed_at":"2026-08-07T11:06:28.009815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.015727Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.015727Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:0c2b6cf4cb241f8ac1845771486b599edc37a4c3a5c321ba78f51acb95988c0e","observation_id":"60dccc4e-9800-48c4-a636-9b9213914097","resolution":{"observed_at":"2026-08-07T11:06:28.015727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.291641Z","title":null,"venue":null,"work_id":"9b495306-cf09-478b-bfed-d4e75e62f16b","year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.025227Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:1a9df9c293448531614c6abef536b943d0647477ca20bd7cbbaa178f5e4308b3","observation_id":"d728f4af-2d43-4ecc-9617-1e5016561efc","resolution":{"observed_at":"2026-08-07T11:06:30.304057Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.035808Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.035808Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:ae1cf37c30975e719282692e9b402f76936aaa040bfe95bf0268e8adc8f04eb1","observation_id":"d9551f98-deaa-4b06-ad09-d0dc32d0d6d3","resolution":{"observed_at":"2026-08-07T11:06:28.035808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.255720Z","title":null,"venue":null,"work_id":"a51a7ee8-686d-4468-8311-d60102c4849b","year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.043852Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:cbe267fbfcf4a5718078e7c0528b91f953d955b728b338192b562b07b60c4abd","observation_id":"d2cb2548-f1c7-474f-a58b-37015e79fb74","resolution":{"observed_at":"2026-08-07T11:06:30.263720Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.050225Z","title":"Rossi, and Thien Huu Nguyen","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.050225Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:dd127d30ddda4b553e9e6aacd9e8260bd5619eb374734fea65e1716f81e74289","observation_id":"10f62dd1-ce18-424a-81f6-8be8b020e4c7","resolution":{"observed_at":"2026-08-07T11:06:28.050225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09400","last_updated":"2023-09-17T23:49:10Z","snapshot_observed_at":"2026-07-06T16:19:41.722419Z","submitted_at":"2023-09-17T23:49:10Z","title":"CulturaX: A Cleaned, Enormous, and Multilingual Dataset for Large Language Models in 167 Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09400","snapshot_observed_at":"2026-08-07T11:06:28.059185Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.059185Z"},"links":{"cited_paper":"/paper/2309.09400","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:c6f07b844e722f5e6ddcac20a60d40123ba7b334149dfd797263536d8304b83c","observation_id":"d26e90d6-4e49-4322-9b63-b76a565e415b","resolution":{"observed_at":"2026-08-07T11:06:28.059185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T11:06:28.065018Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.065018Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:fc7a1b38295391d640a824bf717a15be5ecc3d5571d53c5b90f6d776365531b5","observation_id":"22307517-d91c-40bf-83a1-9b141658c0b6","resolution":{"observed_at":"2026-08-07T11:06:28.065018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.072545Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.072545Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:b7d2d5c1298e6f012c815adc679b1c25ce1f4a94d251ac326c27cd45e5c7f19e","observation_id":"cafa868c-e665-4297-9f9e-3e4901e12979","resolution":{"observed_at":"2026-08-07T11:06:28.072545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.080858Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.080858Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:773cdf1e367a6edae93bcae184a8c41e7110fea2da7004dc86a44dfb9d532a91","observation_id":"3f05f72e-312c-4cdd-99fe-e29812332964","resolution":{"observed_at":"2026-08-07T11:06:28.080858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.088235Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.088235Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:ef99f5acae5115f6155bec92aceaf3d0622256965eb1f8c6f0393b1dc7bb8063","observation_id":"efbb8c1d-50c2-4e83-8c7d-88ee0d591e72","resolution":{"observed_at":"2026-08-07T11:06:28.088235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.163530Z","title":null,"venue":null,"work_id":"4d0834c2-e429-40ca-bec1-53814b710bef","year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.096891Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:649eb0573f91b125d14913025090f5ec343beff50dfb22e7586e37ab8a2a44ec","observation_id":"108bdd21-05bf-49f8-9b87-85bd07c7ecfc","resolution":{"observed_at":"2026-08-07T11:06:30.170869Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.105550Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.105550Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:fcb994e83382e8b7fde309787a941065ab147e9262051c58872a546d31f339b7","observation_id":"03958e7d-eb5c-4100-bc02-4c26eca0ace2","resolution":{"observed_at":"2026-08-07T11:06:28.105550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.111592Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.111592Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:2ca77fe5d7ecb65c1b5abdc8663207ec6d60f78120176510b02fec9ca19afeff","observation_id":"4d2bd9c4-0e56-4533-98da-7c16e76bcd57","resolution":{"observed_at":"2026-08-07T11:06:28.111592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05100","last_updated":"2023-06-27T09:57:58Z","snapshot_observed_at":"2026-08-04T18:56:03.233715Z","submitted_at":"2022-11-09T18:48:09Z","title":"BLOOM: A 176B-Parameter Open-Access Multilingual Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05100","snapshot_observed_at":"2026-08-07T11:06:28.119268Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.119268Z"},"links":{"cited_paper":"/paper/2211.05100","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:1d4a5d7077b16a52cc6e1cf87eafd6f78c0cfedbb0f117b44b4e25313811f6be","observation_id":"b07135c5-407b-465c-9781-d8663560e89c","resolution":{"observed_at":"2026-08-07T11:06:28.119268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.126065Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.126065Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:8cd354b2ab8092fe43f9528ce1b9706147774a14ac387f3eb19ad9ac851de146","observation_id":"153e3fea-44a3-4221-adc0-01e4ae7b3a37","resolution":{"observed_at":"2026-08-07T11:06:28.126065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.131299Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.131299Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:71dc545db11d150f1394c0cc3e7450f313f0079b4f879511edd0e5a2b8b0708f","observation_id":"a61e2436-ee2f-4689-aa11-88dd38da8ef2","resolution":{"observed_at":"2026-08-07T11:06:28.131299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.114949Z","title":null,"venue":null,"work_id":"eb19613f-0a5a-4493-9f16-36ece846a4dc","year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.137833Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3e7c9eebf54fe3c6be1864b8f8b2448def65928d273bc42386066e1da4ac3d81","observation_id":"93a1b02b-0af3-48fc-84bd-d36fd6018372","resolution":{"observed_at":"2026-08-07T11:06:30.122195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T11:06:28.151263Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.151263Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:947dcaa747f03a72aa99ccd346ddea75c3b6262f42a10f0564701caccbc41b6b","observation_id":"ef6ef9e4-2a2e-4217-9fec-8e17b4e41d5d","resolution":{"observed_at":"2026-08-07T11:06:28.151263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.161488Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.161488Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:8dcbab688ac175e3e6a4f34b0380e47de4c27d651651a9b9a7472fb9e2607a00","observation_id":"40f82bdd-db22-45eb-94a7-52a764adf58d","resolution":{"observed_at":"2026-08-07T11:06:28.161488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T11:06:28.173537Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.173537Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:5c00643f3fa69458166335d60fe51f32598decae37dad499aff84a5569c18966","observation_id":"2e1a56a8-8053-4b4a-9777-ee92703131af","resolution":{"observed_at":"2026-08-07T11:06:28.173537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T11:06:28.185682Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.185682Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3f7ee286e46361722aa223646db4698e0a4a68697907ead35798607488e05831","observation_id":"e289c0dd-d679-4ee6-8d3d-f00307982da8","resolution":{"observed_at":"2026-08-07T11:06:28.185682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.07306","last_updated":"2020-04-29T01:16:24Z","snapshot_observed_at":"2026-08-08T07:02:10.284809Z","submitted_at":"2020-02-18T00:22:54Z","title":"From English To Foreign Languages: Transferring Pre-trained Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.07306","snapshot_observed_at":"2026-08-07T11:06:28.194963Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.194963Z"},"links":{"cited_paper":"/paper/2002.07306","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:2fb4379c8f3f78141e6cc90ed87312932f359e2d194d16d6de11db0ba7b6c6b9","observation_id":"8162b23e-5a3e-4c21-8dd4-af5796394e98","resolution":{"observed_at":"2026-08-07T11:06:28.194963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.204407Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.204407Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:b0e96e1a4c0538d9d8a31e9c87d05302d14452874782aa60510d00fe4ebad8ef","observation_id":"9a41635e-aa23-4107-af3b-4de48697d56d","resolution":{"observed_at":"2026-08-07T11:06:28.204407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v32i1.12031","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.450935Z","title":null,"venue":null,"work_id":"2a264f8b-5d88-4680-beab-c30c4357d609","year":2018},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.214523Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:26eed8ec9342212ff0a380d9a0812a72b413554a6e48320d3feeb9136f159754","observation_id":"040dd764-5d69-4e0e-ad8c-bb443754d4c3","resolution":{"observed_at":"2026-08-07T11:06:28.459079Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.092740Z","title":null,"venue":null,"work_id":"27c5ddb1-1c93-4ff3-a955-a0c559263f05","year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.222451Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:1bf23f28b57434309f196d628197fee0472ba283fc8b1f6514d5f81434849cc0","observation_id":"26d22473-6b68-4f0f-b4ab-1b9d4e4411e8","resolution":{"observed_at":"2026-08-07T11:06:30.098615Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19341","last_updated":"2023-10-30T08:31:47Z","snapshot_observed_at":"2026-08-06T06:09:43.812715Z","submitted_at":"2023-10-30T08:31:47Z","title":"Skywork: A More Open Bilingual Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19341","snapshot_observed_at":"2026-08-07T11:06:28.236451Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.236451Z"},"links":{"cited_paper":"/paper/2310.19341","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:8f4c09670982851fa6471e56ddcec78bec50a2c2b00ee0a94becee0f7339a9c9","observation_id":"4f0505ab-7599-4ea0-a285-c18c202b1064","resolution":{"observed_at":"2026-08-07T11:06:28.236451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-07T11:06:28.246726Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.246726Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:85891c416a5c392e1137da9a59ad7664616ad07c61ea037dc9423fbac0f08f6b","observation_id":"82415b58-992f-4d89-b0c7-d6c61be2740e","resolution":{"observed_at":"2026-08-07T11:06:28.246726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-07T11:06:28.253400Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.253400Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:fa33ecd4942a4d43abb376ed8f3ee670b9c3009fe09ebd31e56e53a4b3654112","observation_id":"a08bfc6c-31d5-4bb8-a5bd-5afa9557c19e","resolution":{"observed_at":"2026-08-07T11:06:28.253400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.260265Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.260265Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:23c161d7f9d606c31aaba491295819ae7aef2736fe59cf7d8e1e0bef8203236d","observation_id":"123dd0e2-0bcc-4c3b-87ce-906c585a1a9c","resolution":{"observed_at":"2026-08-07T11:06:28.260265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:30.069190Z","title":null,"venue":null,"work_id":"c1a73bf9-1524-49bf-84f6-1424d9cc584e","year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.268052Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3b38420cfc1183a28b15fcde6af7fae30bf103df189696d0a9ab1b99ae49a815","observation_id":"51657537-7a7c-4902-99db-332a7330036b","resolution":{"observed_at":"2026-08-07T11:06:30.074126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T11:06:28.276072Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.276072Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:49458eed5bc288aa7ca66984ac73a0e372dd389fcb73d6a2bbef70ed4b52a9d5","observation_id":"7ab9372f-3c88-4be1-8d07-a1be3d9dc1dc","resolution":{"observed_at":"2026-08-07T11:06:28.276072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18098","last_updated":"2023-11-21T11:01:24Z","snapshot_observed_at":"2026-07-06T15:34:44.280483Z","submitted_at":"2023-05-29T14:07:52Z","title":"BigTranslate: Augmenting Large Language Models with Multilingual Translation Capability over 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18098","snapshot_observed_at":"2026-08-07T11:06:28.281370Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.281370Z"},"links":{"cited_paper":"/paper/2305.18098","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:047d497019ee8ea4f4873ca0797fd8bcd4f1dc98ba528b2562d103f1a466604b","observation_id":"150c806c-247f-4cc9-a8de-713c035d9176","resolution":{"observed_at":"2026-08-07T11:06:28.281370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.293569Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.293569Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:7636fc36d3589a413f816a7decf3999756506a5f5480109c51f9e88ff378e639","observation_id":"493c65f1-5b4d-43f0-a6f6-1fd0fc4bad26","resolution":{"observed_at":"2026-08-07T11:06:28.293569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.300632Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.300632Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:68ace1574e103ba034f5633999fe75b5fb3e48a25ff0723ffc67c248f015fa6b","observation_id":"76bd9439-540a-4506-8835-44d232f9b2f5","resolution":{"observed_at":"2026-08-07T11:06:28.300632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02385","last_updated":"2024-06-04T02:05:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-04T17:54:59Z","title":"TinyLlama: An Open-Source Small Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02385","snapshot_observed_at":"2026-08-07T11:06:28.308034Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.308034Z"},"links":{"cited_paper":"/paper/2401.02385","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:d6c075f0f4767489d815ddfb9b8ffdf294f58325178aa292fd245f5359aec559","observation_id":"642da0be-7848-404d-a38e-c88656129059","resolution":{"observed_at":"2026-08-07T11:06:28.308034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04948","last_updated":"2023-10-09T14:08:40Z","snapshot_observed_at":"2026-08-07T15:33:01.109380Z","submitted_at":"2023-08-09T13:32:06Z","title":"Extrapolating Large Language Models to Non-English by Aligning Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04948","snapshot_observed_at":"2026-08-07T11:06:28.319125Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.319125Z"},"links":{"cited_paper":"/paper/2308.04948","citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:4ebb5f5e6ec9efeed714bd3327402f60a5c1650c7c0b859061d0c2b9dc5ccc23","observation_id":"b964a25e-4a1b-4914-832a-d5423bccdf05","resolution":{"observed_at":"2026-08-07T11:06:28.319125Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.325225Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.325225Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:5ee3cf9b3e7fd4e7622beca321680ff9d205f8f9a5bdc752b578564c6c736b9c","observation_id":"ce556af2-b395-4ca6-ab46-b551be43c398","resolution":{"observed_at":"2026-08-07T11:06:28.325225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:06:28.332063Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-07T11:06:28.332063Z"},"links":{"citing_paper":"/paper/2506.03523"},"observation_digest":"sha256:3b2f2f4fa35ac08361e4df74775f1a1eda7e7ab5e53268ff797898e658c19d73","observation_id":"5f84288c-08ab-493c-95c9-5b2a24bf8c5c","resolution":{"observed_at":"2026-08-07T11:06:28.332063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03523","last_updated":"2025-06-04T03:15:57Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T02:49:07.968119Z","submitted_at":"2025-06-04T03:15:57Z","title":"TokAlign: Efficient Vocabulary Adaptation via Token Alignment"},"reference_resolution":{"displayed":78,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":77,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":78},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 78 of 78 outbound references and 3 inbound Pith citation observations for arXiv:2506.03523."}