{"as_of":"2026-08-09T13:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:66b325645d3d677d47682ee39b08debcfb1000bd73d2119c623c5e29acaba572","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:05:31.672072Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13158/citation-record","integrity":"/paper/2607.13158/integrity","json":"/paper/2607.13158/citation-record.json","paper":"/paper/2607.13158"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:29.693441Z","title":"Simulmt to simulst: Adapting simul- taneous text translation to end-to-end simultaneous speech translation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:29.693441Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:b5a59be840ca51d24ee9845950b00e0bdf0be7bca8761f857bdf0371d4fdfaa5","observation_id":"0e454bf9-a3fe-40d1-8d34-be1a7469dfbd","resolution":{"observed_at":"2026-08-02T06:05:29.693441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:29.734189Z","title":"Streaming simultaneous speech translation with augmented memory transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:29.734189Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:1d0ac877a9e86b2941cc8cd58cd6fb34b0281abd1be0abe804753f5cd07c0274","observation_id":"ead78c62-1543-49c7-b4a1-6f1e7102bcc6","resolution":{"observed_at":"2026-08-02T06:05:29.734189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-02T06:05:29.793854Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:29.793854Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:b78f5f1b337213e2738c22514411a4ebbdc236aaa7fbe99eb7eabc0046e3e55d","observation_id":"3e43013d-057b-4028-80b2-404fd4060c4e","resolution":{"observed_at":"2026-08-02T06:05:29.793854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-02T06:05:29.859793Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:29.859793Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:cbb0967c54b0b9274a0702f99c13b8445b1d58076e48b185a46bdc3847db9024","observation_id":"f2898b45-6591-4275-bad8-a6766a4446fe","resolution":{"observed_at":"2026-08-02T06:05:29.859793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-02T06:05:29.960245Z","title":"Deepseek-v3 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:29.960245Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:72896b4f4f61377134cc6a1905a439c0db6dbea2b2c25dafa420375cbbe289eb","observation_id":"680b19be-809e-41f4-bd11-8f4a547484bb","resolution":{"observed_at":"2026-08-02T06:05:29.960245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-02T06:05:30.032147Z","title":"Gemma 3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.032147Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:ea0c60c7607c5f4dd19a30574c9d9f797c43bfda0971ad89881f639c1c481338","observation_id":"c96cb376-c040-4059-8ea4-a71ec187ebc5","resolution":{"observed_at":"2026-08-02T06:05:30.032147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-02T06:05:30.087645Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.087645Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:494e225d00fe11ec155f2bedc3cfecde26c24a7ff24da82f4c33a3b2292afcc6","observation_id":"e785e207-74d2-4408-b199-da7bf1cb15a8","resolution":{"observed_at":"2026-08-02T06:05:30.087645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.155103Z","title":"Stacl: Simultaneous translation with implicit anticipation and controllable latency using prefix-to-prefix framework,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.155103Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:6df042681d5cabd429a286e6f4873e07301fac7d3815e4351a304f48e8be7125","observation_id":"ba3c83a5-ce4b-4441-ab03-311edf99140f","resolution":{"observed_at":"2026-08-02T06:05:30.155103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.218904Z","title":"Monotonic infinite lookback attention for simulta- neous machine translation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.218904Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:49fa9a312bf670be0cdffa2bf72b3e52a6de5e055ff17afd94657b0dc25c84fd","observation_id":"bc2ff025-a59e-4d37-9d5c-b17be34d55a5","resolution":{"observed_at":"2026-08-02T06:05:30.218904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.05382","last_updated":"2018-02-23T01:35:36Z","snapshot_observed_at":"2026-08-09T00:00:42.100207Z","submitted_at":"2017-12-14T18:29:42Z","title":"Monotonic Chunkwise Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.05382","snapshot_observed_at":"2026-08-02T06:05:30.314779Z","title":"Monotonic chunkwise attention,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.314779Z"},"links":{"cited_paper":"/paper/1712.05382","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:bd87fc9df29d6aa5a927be19065181365ddf8e3027385e9bd08259e5052ea87a","observation_id":"c81a6c7a-fe1a-45fd-a582-9682941270b5","resolution":{"observed_at":"2026-08-02T06:05:30.314779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.12406","last_updated":"2019-09-26T21:32:50Z","snapshot_observed_at":"2026-08-01T11:32:02.592655Z","submitted_at":"2019-09-26T21:32:50Z","title":"Monotonic Multihead Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.12406","snapshot_observed_at":"2026-08-02T06:05:30.367820Z","title":"Monotonic multihead attention,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.367820Z"},"links":{"cited_paper":"/paper/1909.12406","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:ca4085d6077908792e02ebf9a434c0201fbc1b014d64ac50409fd18274cc8704","observation_id":"c3c5f647-6f99-4aaf-a102-59ee0bb45053","resolution":{"observed_at":"2026-08-02T06:05:30.367820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.428271Z","title":"Re-translation versus streaming for simultaneous translation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.428271Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:647b80c3fffc1118876a617f734f6d131505cb8531895cd3c4f0b671c8cb2090","observation_id":"02525748-b42b-4e15-8801-faf2277c47ef","resolution":{"observed_at":"2026-08-02T06:05:30.428271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.465290Z","title":"Re-translation strategies for long form, simultaneous, spoken language translation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.465290Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:3d34dbc1040357f9a79b4e4d12a067effa9ed2736967df313de2ab030399ed18","observation_id":"8c60cc89-088b-4a4a-b3de-ac89d7708050","resolution":{"observed_at":"2026-08-02T06:05:30.465290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.568407Z","title":"Infinisst: Simultaneous translation of unbounded speech with large language model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.568407Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:d5e709bec7774731693dcfe82bb6bf7f01ec36058394f7adb83512174287299d","observation_id":"7b67829f-6ee1-4396-8983-3e9373f64746","resolution":{"observed_at":"2026-08-02T06:05:30.568407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09430","last_updated":"2024-08-18T10:12:39Z","snapshot_observed_at":"2026-08-09T10:21:15.736650Z","submitted_at":"2024-08-18T10:12:39Z","title":"FASST: Fast LLM-based Simultaneous Speech Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09430","snapshot_observed_at":"2026-08-02T06:05:30.655900Z","title":"Fasst: Fast llm-based si- multaneous speech translation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.655900Z"},"links":{"cited_paper":"/paper/2408.09430","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:6f9c672173c0914537a405d0680b80565959ee5ec4274fe79f447c350d2a6263","observation_id":"c0023d1f-136c-49fe-b96e-71bcdaf77a12","resolution":{"observed_at":"2026-08-02T06:05:30.655900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.709277Z","title":"Cometkiwi: Ist-unbabel 2022 submission for the quality estimation shared task,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.709277Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:b03ae597bf231cca685b4ebac5f7871b3b06b7320fd8b8550a9deb8ac7cb0d42","observation_id":"107c6913-1d3f-4d2b-81fc-d468a841ee67","resolution":{"observed_at":"2026-08-02T06:05:30.709277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.766270Z","title":"Simuleval: An evaluation toolkit for simultaneous translation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.766270Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:bdb48a7eaebe51b4dcecbf619bd48bae6f86d92a93582ba6a2f557699678393d","observation_id":"87fa4254-0426-4a6f-9828-ba6bb2e846b1","resolution":{"observed_at":"2026-08-02T06:05:30.766270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.810114Z","title":"Simulspeech: End-to-end simultaneous speech to text translation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.810114Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:a78b3fa238e0649c35c0fd6ee361c078b91f719ceb95fd6801ab1e2330f52d15","observation_id":"f2b4f1b4-8abb-4d17-b2c3-e66ab3a2f0ad","resolution":{"observed_at":"2026-08-02T06:05:30.810114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.865370Z","title":"Align, write, re-order: Explainable end-to-end speech translation via operation sequence generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.865370Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:fa24b67496b18a10c45211dcaf7b6321a9518a2b797c86c3c6f760906991050b","observation_id":"03cbfcdf-9c5e-4e94-ad7a-3d7bafd991cc","resolution":{"observed_at":"2026-08-02T06:05:30.865370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:30.942796Z","title":"Direct simultaneous speech- to-text translation assisted by synchronized streaming asr,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:30.942796Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:972995b42f1deefd3024e389339997874a48a59427b35bffbb3b078417a12c7f","observation_id":"c14e19fb-cd2e-4324-b2f4-ea01c980d945","resolution":{"observed_at":"2026-08-02T06:05:30.942796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:31.008217Z","title":"Improving simultaneous translation by incorporating pseudo-references with fewer reorderings,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.008217Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:6b8bd649daae2107a8ec355f806ca75a3df1052dad200cc862ec45ecf6d2cc83","observation_id":"86fb56f6-10cf-4757-9bf9-7ebedbcadd66","resolution":{"observed_at":"2026-08-02T06:05:31.008217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01743","last_updated":"2025-03-07T09:05:58Z","snapshot_observed_at":"2026-08-09T11:59:10.408717Z","submitted_at":"2025-03-03T17:05:52Z","title":"Phi-4-Mini Technical Report: Compact yet Powerful Multimodal Language Models via Mixture-of-LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01743","snapshot_observed_at":"2026-08-02T06:05:31.054065Z","title":"Phi-4-mini technical report: Compact yet powerful multimodal language models via mixture- of-LoRAs,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.054065Z"},"links":{"cited_paper":"/paper/2503.01743","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:879ce75dab9041559e6c9ad5afe0d2020916eda05271c97d63157641d6c28afa","observation_id":"bd874a67-328d-4f09-9039-8aec04436b5b","resolution":{"observed_at":"2026-08-02T06:05:31.054065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05352","last_updated":"2022-07-01T20:41:39Z","snapshot_observed_at":"2026-08-09T07:22:54.903835Z","submitted_at":"2022-04-11T18:18:53Z","title":"Large-Scale Streaming End-to-End Speech Translation with Neural Transducers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05352","snapshot_observed_at":"2026-08-02T06:05:31.096339Z","title":"Large-scale streaming end-to-end speech translation with neural transducers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.096339Z"},"links":{"cited_paper":"/paper/2204.05352","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:cf33ffd33e162cc330cbc4946e6704a786b06257b701d04373ab04400d4b2bae","observation_id":"85095951-4a55-4231-9567-3c93be094dd4","resolution":{"observed_at":"2026-08-02T06:05:31.096339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:31.144798Z","title":"Conformer: Convolution- augmented Transformer for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.144798Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:9e4cdc173c43cc5b3024f7aa5daf75b91890bc9661d7edf19975bfed09d32b10","observation_id":"a0736aa5-53ca-4c00-9284-b314a4808713","resolution":{"observed_at":"2026-08-02T06:05:31.144798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19363","last_updated":"2024-06-27T17:45:34Z","snapshot_observed_at":"2026-08-02T19:09:54.345699Z","submitted_at":"2024-06-27T17:45:34Z","title":"Tradition or Innovation: A Comparison of Modern ASR Methods for Forced Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19363","snapshot_observed_at":"2026-08-02T06:05:31.228571Z","title":"Tradition or innova- tion: A comparison of modern asr methods for forced alignment,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.228571Z"},"links":{"cited_paper":"/paper/2406.19363","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:138eac76c5e24e28abd2d65f279a898773f45062a0356ace929c0d08de2097fa","observation_id":"86114df3-785f-4795-b29d-79c09c267a3b","resolution":{"observed_at":"2026-08-02T06:05:31.228571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:31.310001Z","title":"Covost 2 and massively mul- tilingual speech translation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.310001Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:4df10f256535141e18ce922d806092cbe3795b947010b1baadd490e15c9fc2e6","observation_id":"57869bbb-429b-4c04-8be6-15dd42f7a0bc","resolution":{"observed_at":"2026-08-02T06:05:31.310001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:31.365029Z","title":"A call for clarity in reporting BLEU scores,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.365029Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:bcfe8f586971666e6836356942a86507a8f04823b163f6239fe5a75091f1583d","observation_id":"e84d7726-6585-479f-9788-f48339efff73","resolution":{"observed_at":"2026-08-02T06:05:31.365029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:31.412067Z","title":"Low-latency sequence-to-sequence speech recognition and translation by partial hypothesis selection,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.412067Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:64f79cff01fa93e9c7cf45810c6ac6ec2bd0b230e2338cf5f2a66d2f3893aa7b","observation_id":"c18a87bc-c1b8-4803-982d-9602dd51ab89","resolution":{"observed_at":"2026-08-02T06:05:31.412067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:31.488168Z","title":"CUNI-KIT system for simultaneous speech translation task at IWSLT 2022,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.488168Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:278fd1746b07ecc9cfc8efc7cfcf0d7952a92faa5ab8910f6ed7574c01c7d7cb","observation_id":"5f077d30-ee70-4eb3-86d7-c04819ec94c7","resolution":{"observed_at":"2026-08-02T06:05:31.488168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:31.540467Z","title":"Re-translation versus streaming for simultaneous translation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.540467Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:733cae321ed9c6b657d4223ac65634ca5ed2a38bab7ab0c5e32d2463e4b15a9e","observation_id":"9bf0aeea-be83-4d03-a71b-1bfba3be0992","resolution":{"observed_at":"2026-08-02T06:05:31.540467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T06:05:31.619546Z","title":"Simultaneous neural machine translation with prefix alignment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.619546Z"},"links":{"citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:983b1feb283b1c353a760a6aeb1e93fcf28aec958a4223767d8a9c3709c47182","observation_id":"d51e4e96-d0cf-4303-8b09-e03d0a40bc5d","resolution":{"observed_at":"2026-08-02T06:05:31.619546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11809","last_updated":"2025-04-16T06:46:15Z","snapshot_observed_at":"2026-08-08T16:59:03.390087Z","submitted_at":"2025-04-16T06:46:15Z","title":"Efficient and Adaptive Simultaneous Speech Translation with Fully Unidirectional Architecture","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11809","snapshot_observed_at":"2026-08-02T06:05:31.672072Z","title":"Efficient and adaptive simultaneous speech translation with fully unidirectional architecture,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T06:05:31.672072Z"},"links":{"cited_paper":"/paper/2504.11809","citing_paper":"/paper/2607.13158"},"observation_digest":"sha256:3bb5e5c90edefda674bca7c589c52416ef37526376ff3bd3c066f28a72e08c87","observation_id":"3b960464-af5c-4be7-93ee-8618a1cb5f8e","resolution":{"observed_at":"2026-08-02T06:05:31.672072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13158","last_updated":"2026-07-14T18:07:18Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T02:39:16.567546Z","submitted_at":"2026-07-14T18:07:18Z","title":"Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2607.13158."}