{"as_of":"2026-08-11T09:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd57ff2873fd161f8af8821178e31e39a6a349c8819aa27d9e360ea184c61e30","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:52:43.139901Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T17:45:42.428939Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"cited_work":{"arxiv_id":"2507.17527","doi":"10.48550/arxiv.2507.17527","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17527","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seed liveinterpret 2.0: End-to-end simultaneous speech-to-speech translation with your voice","venue":"arXiv (Cornell University)","work_id":"b534a04c-e5e9-4dc2-a47c-3c29a66c873c","year":2025},"citing_paper":{"arxiv_id":"2604.09916","last_updated":"2026-04-10T21:20:55Z","snapshot_observed_at":"2026-08-06T10:06:52.002345Z","submitted_at":"2026-04-10T21:20:55Z","title":"Regularized Entropy Information Adaptation with Temporal-Awareness Networks for Simultaneous Speech Translation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T17:12:56.433339Z"},"links":{"cited_paper":"/paper/2507.17527","citing_paper":"/paper/2604.09916"},"observation_digest":"sha256:5bfb7b9c2c7ce492d1c3f474f6f3811800bf188c3d6e1c2f74b5de8aef40c9d1","observation_id":"8f1ae966-92f1-4fe1-bc37-4c23e692eb57","resolution":{"observed_at":"2026-05-11T07:20:59.342212Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"cited_work":{"arxiv_id":"2507.17527","doi":"10.48550/arxiv.2507.17527","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17527","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seed liveinterpret 2.0: End-to-end simultaneous speech-to-speech translation with your voice","venue":"arXiv (Cornell University)","work_id":"b534a04c-e5e9-4dc2-a47c-3c29a66c873c","year":2025},"citing_paper":{"arxiv_id":"2606.00523","last_updated":"2026-05-30T04:31:29Z","snapshot_observed_at":"2026-07-06T23:41:15.410587Z","submitted_at":"2026-05-30T04:31:29Z","title":"ProactiveLLM: Learning Active Interaction for Streaming Large Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-06-28T19:07:48.425181Z"},"links":{"cited_paper":"/paper/2507.17527","citing_paper":"/paper/2606.00523"},"observation_digest":"sha256:6c4c3a4fa2d86e943f6fc531ce26f6dd0a39662d20b2e24c7c9ccc57aff19f51","observation_id":"7e370a72-ad33-4bee-b035-efa813c21f41","resolution":{"observed_at":"2026-06-28T19:12:34.858926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"cited_work":{"arxiv_id":"2507.17527","doi":"10.48550/arxiv.2507.17527","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17527","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seed liveinterpret 2.0: End-to-end simultaneous speech-to-speech translation with your voice","venue":"arXiv (Cornell University)","work_id":"b534a04c-e5e9-4dc2-a47c-3c29a66c873c","year":2025},"citing_paper":{"arxiv_id":"2606.11219","last_updated":"2026-05-11T20:27:40Z","snapshot_observed_at":"2026-08-05T20:46:41.277498Z","submitted_at":"2026-05-11T20:27:40Z","title":"Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents","version":1},"reference_index":197,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:44.891731Z"},"links":{"cited_paper":"/paper/2507.17527","citing_paper":"/paper/2606.11219"},"observation_digest":"sha256:4c79e019824619edfa92df726dd8b13df6bb4b644602db38302fba9c78f36bf2","observation_id":"2b872252-da54-4841-85cc-94aae01b974b","resolution":{"observed_at":"2026-06-30T22:15:05.188164Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"cited_work":{"arxiv_id":"2507.17527","doi":"10.48550/arxiv.2507.17527","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.17527","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seed liveinterpret 2.0: End-to-end simultaneous speech-to-speech translation with your voice","venue":"arXiv (Cornell University)","work_id":"b534a04c-e5e9-4dc2-a47c-3c29a66c873c","year":2025},"citing_paper":{"arxiv_id":"2606.17255","last_updated":"2026-06-15T19:57:05Z","snapshot_observed_at":"2026-08-07T17:45:17.683151Z","submitted_at":"2026-06-15T19:57:05Z","title":"MLLP-VRAIN UPV system for the IWSLT 2026 Simultaneous Speech Translation task","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T03:12:21.284880Z"},"links":{"cited_paper":"/paper/2507.17527","citing_paper":"/paper/2606.17255"},"observation_digest":"sha256:0b55c6545927c20681aab9864a82e8dd83a98e4d023847ad047ec1af5cf00f07","observation_id":"26d6ae43-46b4-497d-8b86-02c8a9c3759f","resolution":{"observed_at":"2026-06-27T03:20:26.927280Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.17527","snapshot_observed_at":"2026-08-01T17:45:42.428939Z","title":"arXiv preprint arXiv:2507.17527 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17544","last_updated":"2026-07-20T04:42:07Z","snapshot_observed_at":"2026-08-07T11:10:34.915152Z","submitted_at":"2026-07-20T04:42:07Z","title":"X-Translator: A Real-Time Multilingual Speaker-Aware Speech-to-Speech Translation System","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T17:45:42.428939Z"},"links":{"cited_paper":"/paper/2507.17527","citing_paper":"/paper/2607.17544"},"observation_digest":"sha256:0f6e48f177c6e08e7df39f6e82eb699d05606880b61a934a961cbf6474ed3506","observation_id":"d9d0909c-30a2-4abc-814c-03659acb8eb1","resolution":{"observed_at":"2026-08-01T17:45:42.428939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.17527/citation-record","integrity":"/paper/2507.17527/integrity","json":"/paper/2507.17527/citation-record.json","paper":"/paper/2507.17527"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.17733","last_updated":"2024-02-27T18:09:36Z","snapshot_observed_at":"2026-08-11T03:41:33.496334Z","submitted_at":"2024-02-27T18:09:36Z","title":"Tower: An Open Multilingual Large Language Model for Translation-Related Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17733","snapshot_observed_at":"2026-08-06T14:52:42.937483Z","title":"Tower: An open multilingual large language model for translation-related tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.937483Z"},"links":{"cited_paper":"/paper/2402.17733","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:f5f897bc745eab7aa3e3bac7b0b973ba901c0e2777ccaba96d82d311fa381c08","observation_id":"42334389-0117-49b5-ba54-c3ad0762cdcb","resolution":{"observed_at":"2026-08-06T14:52:42.937483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02430","last_updated":"2024-06-04T15:48:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-04T15:48:29Z","title":"Seed-TTS: A Family of High-Quality Versatile Speech Generation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02430","snapshot_observed_at":"2026-08-06T14:52:42.942516Z","title":"Seed-tts: A family of high-quality versatile speech generation models.arXiv preprint arXiv:2406.02430, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.942516Z"},"links":{"cited_paper":"/paper/2406.02430","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:b6060c2c4bdd7b1c0ebffd85580cd3c65fb8a49f36a7227e5ebc1b0c326d580a","observation_id":"b4245843-32f7-45af-b82e-a5839e43af1a","resolution":{"observed_at":"2026-08-06T14:52:42.942516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.05218","last_updated":"2019-06-12T15:49:31Z","snapshot_observed_at":"2026-08-07T23:49:03.922415Z","submitted_at":"2019-06-12T15:49:31Z","title":"Monotonic Infinite Lookback Attention for Simultaneous Machine Translation","version":1},"cited_work":{"arxiv_id":"1906.05218","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.05218","snapshot_observed_at":"2026-08-06T14:52:43.823912Z","title":"Monotonic Infinite Lookback Attention for Simultaneous Machine Translation","venue":"cs.CL","work_id":"1e9ad758-b468-4c33-bf9c-509dc108f1b7","year":2019},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.947303Z"},"links":{"cited_paper":"/paper/1906.05218","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:f6fb1117493d8ecb2e5eaec08c618c26ad7a18f846a41f30cbe87e1142b702b8","observation_id":"fd3273fa-13bb-4c0c-890c-1b06549c816b","resolution":{"observed_at":"2026-08-06T14:52:43.831690Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04675","last_updated":"2024-07-10T09:01:17Z","snapshot_observed_at":"2026-07-06T18:42:05.670928Z","submitted_at":"2024-07-05T17:38:03Z","title":"Seed-ASR: Understanding Diverse Speech and Contexts with LLM-based Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04675","snapshot_observed_at":"2026-08-06T14:52:42.951815Z","title":"Seed-asr: Understanding diverse speech and contexts with llm-based speech recognition","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.951815Z"},"links":{"cited_paper":"/paper/2407.04675","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:274a0c303da57915605b8d6deecbbe7e2d35e1822de400d9c30854c4b6390b4d","observation_id":"dddc8553-5bbc-4af2-9566-eaf72d02e81b","resolution":{"observed_at":"2026-08-06T14:52:42.951815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05187","last_updated":"2023-12-08T17:18:42Z","snapshot_observed_at":"2026-08-06T14:36:57.042438Z","submitted_at":"2023-12-08T17:18:42Z","title":"Seamless: Multilingual Expressive and Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05187","snapshot_observed_at":"2026-08-06T14:52:42.956099Z","title":"Seamless: Multilingual expressive and streaming speech translation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.956099Z"},"links":{"cited_paper":"/paper/2312.05187","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:f47ba33627018d3376286ec4ba12bfadd877720a158328d16f7e561c237d9eb5","observation_id":"ec7eb0f9-ab53-4ee6-bd44-073d934ca742","resolution":{"observed_at":"2026-08-06T14:52:42.956099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21646","last_updated":"2024-08-30T06:50:51Z","snapshot_observed_at":"2026-07-06T18:55:02.790902Z","submitted_at":"2024-07-31T14:48:27Z","title":"Towards Achieving Human Parity on End-to-end Simultaneous Speech Translation via LLM Agent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21646","snapshot_observed_at":"2026-08-06T14:52:42.960101Z","title":"Towards achieving human parity on end-to-end simultaneous speech translation via llm agent, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.960101Z"},"links":{"cited_paper":"/paper/2407.21646","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:49cbda316a9071e5d3a6e8b536a61494a18019481fb6ab09bcf4a6fb8893873e","observation_id":"73503006-80b7-441e-8725-4da45783c25c","resolution":{"observed_at":"2026-08-06T14:52:42.960101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.02012","last_updated":"2016-06-07T03:38:46Z","snapshot_observed_at":"2026-07-06T04:59:01.701765Z","submitted_at":"2016-06-07T03:38:46Z","title":"Can neural machine translation do simultaneous translation?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.02012","snapshot_observed_at":"2026-08-06T14:52:42.964805Z","title":"Can neural machine translation do simultaneous translation?arXiv preprint arXiv:1606.02012, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.964805Z"},"links":{"cited_paper":"/paper/1606.02012","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:2f01bb5052979b8860b111e841909a44b85cbc6ddd945b59f2e04922f85c1f3b","observation_id":"fc118328-db2d-48d6-b322-c33f3d180e40","resolution":{"observed_at":"2026-08-06T14:52:42.964805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-06T14:52:42.968709Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models.arXiv preprint arXiv:2311.07919, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.968709Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:3b59491b070abc2132e7587a4ba26e898ecc6c5739543ed281db35fda39947e3","observation_id":"8eba585b-6a07-4880-917f-2c0e97878b31","resolution":{"observed_at":"2026-08-06T14:52:42.968709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08595","last_updated":"2020-08-04T01:10:35Z","snapshot_observed_at":"2026-08-10T21:55:50.400456Z","submitted_at":"2020-05-18T11:14:23Z","title":"Efficient Wait-k Models for Simultaneous Machine Translation","version":2},"cited_work":{"arxiv_id":"2005.08595","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.08595","snapshot_observed_at":"2026-08-06T14:52:43.735591Z","title":"Efficient Wait-k Models for Simultaneous Machine Translation","venue":"cs.CL","work_id":"02c56ba5-c350-4292-9ea7-4912fb988373","year":2020},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.972649Z"},"links":{"cited_paper":"/paper/2005.08595","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:ac1e8000bcb95e1f7d56fefcda8377aed5ba7fa951fb2f07d313a7bc7726894e","observation_id":"75423757-986b-44a0-ac56-598ba72a714e","resolution":{"observed_at":"2026-08-06T14:52:43.739828Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10160","last_updated":"2025-04-14T12:14:18Z","snapshot_observed_at":"2026-08-10T10:51:01.289012Z","submitted_at":"2025-04-14T12:14:18Z","title":"MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10160","snapshot_observed_at":"2026-08-06T14:52:42.976548Z","title":"Mt-r1-zero: Advancing llm-based machine translation via r1-zero-like reinforcement learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.976548Z"},"links":{"cited_paper":"/paper/2504.10160","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:a0b60dfd68cae2bea1e0b3442d31a9852a3ace56b7f0a61dfd844e97cd2a5649","observation_id":"cdd2b602-83a4-4d2f-b263-da4843ac94ad","resolution":{"observed_at":"2026-08-06T14:52:42.976548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:44.019784Z","title":"Naist simultaneous speech-to-speech translation system for iwslt","venue":null,"work_id":"f5d4ad93-38d8-4b94-a2e0-2a8f4ef1dab7","year":null},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.980467Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:cbec4d46aad870b6a132a9faf04cf7d28d4a5195768aa159c49f07f02212619f","observation_id":"6c687f88-f18e-4fc4-bfe5-d5e2de4db7ab","resolution":{"observed_at":"2026-08-06T14:52:44.025093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12025","last_updated":"2024-11-29T10:46:22Z","snapshot_observed_at":"2026-08-07T21:26:09.838700Z","submitted_at":"2024-02-19T10:34:13Z","title":"Speech Translation with Speech Foundation Models and Large Language Models: What is There and What is Missing?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12025","snapshot_observed_at":"2026-08-06T14:52:42.988021Z","title":"Speech translation with speech foundation models and large language models: What is there and what is missing?arXiv preprint arXiv:2402.12025 , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.988021Z"},"links":{"cited_paper":"/paper/2402.12025","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:0f9cc02982634864e2e6cf980fe0cece9608ead23cfd352658c7911707836ae9","observation_id":"38046375-498a-4556-b70e-52935f510ba9","resolution":{"observed_at":"2026-08-06T14:52:42.988021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.00388","last_updated":"2017-01-10T21:07:56Z","snapshot_observed_at":"2026-08-10T06:22:14.395198Z","submitted_at":"2016-10-03T02:11:03Z","title":"Learning to Translate in Real-time with Neural Machine Translation","version":3},"cited_work":{"arxiv_id":"1610.00388","doi":null,"metadata_source":"pith","pith_arxiv_id":"1610.00388","snapshot_observed_at":"2026-08-06T14:52:43.689916Z","title":"Learning to Translate in Real-time with Neural Machine Translation","venue":"cs.CL","work_id":"5b3cb71d-b4b8-4ab2-8bcc-6fb0a96289d6","year":2016},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.991680Z"},"links":{"cited_paper":"/paper/1610.00388","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:1910716e44c6c8290d34b97d5c5e0229786884a76d28c796fea153b2c10b3920","observation_id":"96bca745-86f1-4856-a048-1246d87f9e1f","resolution":{"observed_at":"2026-08-06T14:52:43.694484Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T14:52:42.996257Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.996257Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:bf57a79784f3b99798d9b89d793e0ff1dd2adb9c798f4d6a313a385d24ae56f8","observation_id":"69ac5714-81ea-4ee1-9ed0-33dd63735102","resolution":{"observed_at":"2026-08-06T14:52:42.996257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.19735","last_updated":"2025-05-26T10:07:21Z","snapshot_observed_at":"2026-08-07T17:44:14.954368Z","submitted_at":"2025-02-27T03:57:00Z","title":"R1-T1: Fully Incentivizing Translation Capability in LLMs via Reasoning Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.19735","snapshot_observed_at":"2026-08-06T14:52:42.999830Z","title":"R1-t1: Fully incentivizing translation capability in llms via reasoning learning.arXiv preprint arXiv:2502.19735, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.999830Z"},"links":{"cited_paper":"/paper/2502.19735","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:5e533a710d61227e51138e4c84bec9ec011ec99d00a0f472be1e6472fe6734f1","observation_id":"4b56b201-425b-466c-ba16-e064882215b5","resolution":{"observed_at":"2026-08-06T14:52:42.999830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.12873","last_updated":"2024-03-18T15:16:16Z","snapshot_observed_at":"2026-07-06T17:19:27.816085Z","submitted_at":"2024-01-23T16:07:43Z","title":"Improving Machine Translation with Human Feedback: An Exploration of Quality Estimation as a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12873","snapshot_observed_at":"2026-08-06T14:52:43.003797Z","title":"Improving machine translation with human feedback: An exploration of quality estimation as a reward model.arXiv preprint arXiv:2401.12873, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.003797Z"},"links":{"cited_paper":"/paper/2401.12873","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:d0329598d50d546c2a953423e2639c542c762f1f5a2a85630f6d1bf887f37acd","observation_id":"a249e924-b414-4285-baa4-40e76ad510ab","resolution":{"observed_at":"2026-08-06T14:52:43.003797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13585","last_updated":"2023-12-21T05:32:49Z","snapshot_observed_at":"2026-08-09T02:04:31.523385Z","submitted_at":"2023-12-21T05:32:49Z","title":"Speech Translation with Large Language Models: An Industrial Practice","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13585","snapshot_observed_at":"2026-08-06T14:52:43.007545Z","title":"Speech translation with large language models: An industrial practice.arXiv preprint arXiv:2312.13585 , 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.007545Z"},"links":{"cited_paper":"/paper/2312.13585","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:d569bcafc82dc5a50017f59ace5babb5272b29f3260d843cfce83797bc230b6a","observation_id":"5a9ed7e5-45c0-4fe4-8dff-06d0e2798adb","resolution":{"observed_at":"2026-08-06T14:52:43.007545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.06037","last_updated":"2019-06-25T21:34:10Z","snapshot_observed_at":"2026-08-10T04:02:51.637084Z","submitted_at":"2019-04-12T05:15:31Z","title":"Direct speech-to-speech translation with a sequence-to-sequence model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.06037","snapshot_observed_at":"2026-08-06T14:52:43.011809Z","title":"Direct speech-to-speech translation with a sequence-to-sequence model.arXiv preprint arXiv:1904.06037 , 2019","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.011809Z"},"links":{"cited_paper":"/paper/1904.06037","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:aca819cdf5b6ca2ec499b80065c290b4aaf3121bac8504c2a5be17657bc9c8b1","observation_id":"4173c832-589f-4f00-9ed1-40caf03ef46a","resolution":{"observed_at":"2026-08-06T14:52:43.011809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.993056Z","title":"Conference interpreting explained","venue":null,"work_id":"d609f980-267f-4bf0-aa40-945a71023c15","year":2014},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.015799Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:f0914b1206239cb0f359f277d52384223e5c89fbf72c41fc49438a1bd553ed6d","observation_id":"aee1bf8d-bc6f-492b-9e4b-ae619e658063","resolution":{"observed_at":"2026-08-06T14:52:43.997014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15124","last_updated":"2025-04-14T22:39:09Z","snapshot_observed_at":"2026-08-10T16:05:13.426341Z","submitted_at":"2024-11-22T18:44:04Z","title":"Tulu 3: Pushing Frontiers in Open Language Model Post-Training","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15124","snapshot_observed_at":"2026-08-06T14:52:43.019427Z","title":"T\\\" ulu 3: Pushing frontiers in open language model post-training","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.019427Z"},"links":{"cited_paper":"/paper/2411.15124","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:fdf322dc03e9f466373930585becdac61b5d11cc4298f69c038947a564444407","observation_id":"5eb2c6fd-f9c2-4543-b544-39f58e8fdbeb","resolution":{"observed_at":"2026-08-06T14:52:43.019427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.979588Z","title":null,"venue":null,"work_id":"f07eae14-d2eb-4fee-9014-ea3f7a8b8ee7","year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.023198Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:8283015cc6a7cb889914aa8ba906b91414c13f2f793402e3075e2463d984aebe","observation_id":"6bbf4f01-8e48-4e4a-966c-9d1ee7df200b","resolution":{"observed_at":"2026-08-06T14:52:43.984097Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.965412Z","title":"Cross attention augmented transducer networks for simultaneous translation","venue":null,"work_id":"e73677ce-0a61-48b3-b8c1-905c8506bae8","year":2021},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.026816Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:97c80c4700eb81943945098480866206f1e9f3877dd3ed8d7e6960f519d6c713","observation_id":"67de62a4-515c-4196-b2e3-f6a95dc2c2dd","resolution":{"observed_at":"2026-08-06T14:52:43.969863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05975","last_updated":"2024-10-12T03:20:44Z","snapshot_observed_at":"2026-08-09T09:45:58.853554Z","submitted_at":"2024-07-08T14:18:28Z","title":"LLaMAX: Scaling Linguistic Horizons of LLM by Enhancing Translation Capabilities Beyond 100 Languages","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05975","snapshot_observed_at":"2026-08-06T14:52:43.030561Z","title":"Llamax: Scaling linguistic horizons of llm by enhancing translation capabilities beyond 100 languages.arXiv preprint arXiv:2407.05975 , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.030561Z"},"links":{"cited_paper":"/paper/2407.05975","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:824938fc82d0b27a6a48dcf7ea8a6afbe82eab321dd71d70fde95c2fbdc78003","observation_id":"338314c6-dd10-421d-88ea-96cff8b3069c","resolution":{"observed_at":"2026-08-06T14:52:43.030561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08967","last_updated":"2024-12-13T04:44:11Z","snapshot_observed_at":"2026-08-10T22:26:40.697702Z","submitted_at":"2024-01-17T04:43:21Z","title":"ReFT: Reasoning with Reinforced Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08967","snapshot_observed_at":"2026-08-06T14:52:43.034343Z","title":"Reft: Reasoning with reinforced fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.034343Z"},"links":{"cited_paper":"/paper/2401.08967","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:c60af08afea9cd9ccb0d7a1382fab2ddba328e002f272688c2929470a25b7a5e","observation_id":"85fb2d14-dd27-47b3-8cea-2c384eabee1f","resolution":{"observed_at":"2026-08-06T14:52:43.034343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.08398","last_updated":"2019-06-24T21:35:07Z","snapshot_observed_at":"2026-08-03T06:11:18.979670Z","submitted_at":"2018-10-19T08:37:40Z","title":"STACL: Simultaneous Translation with Implicit Anticipation and Controllable Latency using Prefix-to-Prefix Framework","version":5},"cited_work":{"arxiv_id":"1810.08398","doi":null,"metadata_source":"pith","pith_arxiv_id":"1810.08398","snapshot_observed_at":"2026-08-06T14:52:43.557519Z","title":"STACL: Simultaneous Translation with Implicit Anticipation and Controllable Latency using Prefix-to-Prefix Framework","venue":"cs.CL","work_id":"a3cf43e1-36cb-447f-8859-afe60fa9f264","year":2018},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.037959Z"},"links":{"cited_paper":"/paper/1810.08398","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:40c46dcf0f24eb5343c7b48102d51d804387f0c4d638bc4465d23cf40b49bb40","observation_id":"061f8690-7e0d-4ca7-bfa9-dbf39173d491","resolution":{"observed_at":"2026-08-06T14:52:43.561713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.08633","last_updated":"2023-06-01T15:00:49Z","snapshot_observed_at":"2026-08-03T14:46:19.970626Z","submitted_at":"2022-11-16T03:03:56Z","title":"MT Metrics Correlate with Human Ratings of Simultaneous Speech Translation","version":2},"cited_work":{"arxiv_id":"2211.08633","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.08633","snapshot_observed_at":"2026-08-06T14:52:43.538763Z","title":"MT Metrics Correlate with Human Ratings of Simultaneous Speech Translation","venue":"cs.CL","work_id":"d2f87d7c-21c6-4131-92be-782831d803a6","year":2022},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.043419Z"},"links":{"cited_paper":"/paper/2211.08633","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:bbcb0b3bbb6ab1c196c282d59c6a7c00a6c826981c800029a8f8ddbf0a9c2227","observation_id":"eeaf4f46-a102-4c62-a4cc-08025a92d1a8","resolution":{"observed_at":"2026-08-06T14:52:43.543476Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.949392Z","title":"Reinforcementfine-tuning","venue":null,"work_id":"e2ac2d80-fddf-4d59-b66f-a528e4ae68f9","year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.047458Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:6de53d84399d875e126bc39cdc9351dbd1b04ab85b33d34ac35aa6604ec7fb82","observation_id":"0bc021cd-07d8-4e5a-812e-001365e279b5","resolution":{"observed_at":"2026-08-06T14:52:43.955158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13143","last_updated":"2025-06-16T06:56:21Z","snapshot_observed_at":"2026-08-11T07:47:18.604279Z","submitted_at":"2025-06-16T06:56:21Z","title":"CMU's IWSLT 2025 Simultaneous Speech Translation System","version":1},"cited_work":{"arxiv_id":"2506.13143","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13143","snapshot_observed_at":"2026-08-06T14:52:43.519632Z","title":"CMU's IWSLT 2025 Simultaneous Speech Translation System","venue":"cs.CL","work_id":"04482b5c-bc0c-4ea5-8492-73b28ff5396f","year":2025},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.051262Z"},"links":{"cited_paper":"/paper/2506.13143","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:10c8832b01a7e515672db4ccb76aef4c905121495d323f0f6b954af5e6317513","observation_id":"33a83bc6-4cd4-4f24-aeab-438627fc15d1","resolution":{"observed_at":"2026-08-06T14:52:43.523804Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12915","last_updated":"2024-07-07T08:16:28Z","snapshot_observed_at":"2026-07-06T18:17:25.642584Z","submitted_at":"2024-05-21T16:38:13Z","title":"G-DIG: Towards Gradient-based Diverse and High-quality Instruction Data Selection for Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12915","snapshot_observed_at":"2026-08-06T14:52:43.055284Z","title":"G-dig: Towards gradient- based diverse and high-quality instruction data selection for machine translation.arXiv preprint arXiv:2405.12915, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.055284Z"},"links":{"cited_paper":"/paper/2405.12915","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:4f0a2dcbde805b216d10d088724fa369aaf052e549b6d0150cbe4e990c7a131a","observation_id":"77eedcc7-db13-43f2-a5fa-be32324e5813","resolution":{"observed_at":"2026-08-06T14:52:43.055284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.05807","last_updated":"2022-06-20T12:03:56Z","snapshot_observed_at":"2026-08-03T16:11:05.118703Z","submitted_at":"2022-06-12T18:00:08Z","title":"Over-Generation Cannot Be Rewarded: Length-Adaptive Average Lagging for Simultaneous Speech Translation","version":3},"cited_work":{"arxiv_id":"2206.05807","doi":null,"metadata_source":"pith","pith_arxiv_id":"2206.05807","snapshot_observed_at":"2026-08-06T14:52:43.485739Z","title":"Over-Generation Cannot Be Rewarded: Length-Adaptive Average Lagging for Simultaneous Speech Translation","venue":"cs.CL","work_id":"3a315b4d-ea75-4432-b253-503c4788f3b4","year":2022},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.059192Z"},"links":{"cited_paper":"/paper/2206.05807","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:7fe9628fa94693a7de5d0b38e9e178c36ac55a17ebe5c1e59e685124313b5d2a","observation_id":"99af74ee-6888-427e-91fc-1b8ce42c5f30","resolution":{"observed_at":"2026-08-06T14:52:43.490093Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.932424Z","title":"How “real” is your real-time simultaneous speech-to-text translation system? Transactions of the Association for Computational Linguistics , 13:281–313, 2025","venue":null,"work_id":"692fabb5-0458-41e1-b081-fb1359471090","year":2025},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.063226Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:fd2ea3eea1f78b8e22f318ee07c5d1e058923dfd383b335af3245166b56ed3c8","observation_id":"e458a1d6-229e-44e6-8679-e2e1c5eba9ae","resolution":{"observed_at":"2026-08-06T14:52:43.938184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09025","last_updated":"2020-10-19T14:10:10Z","snapshot_observed_at":"2026-08-04T14:24:24.611946Z","submitted_at":"2020-09-18T18:54:15Z","title":"COMET: A Neural Framework for MT Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09025","snapshot_observed_at":"2026-08-06T14:52:43.066984Z","title":"Comet: A neural framework for mt evaluation","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.066984Z"},"links":{"cited_paper":"/paper/2009.09025","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:937d7e9fc7b2c9e745e11a8397ebeb6b6533551039bfa53ce19235074aec5a75","observation_id":"a4220b49-8299-47d9-9bc0-f06143614d00","resolution":{"observed_at":"2026-08-06T14:52:43.066984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.916602Z","title":"Simulspeech: End-to-end simultaneous speech to text translation","venue":null,"work_id":"55d2f588-7d16-47d0-8aca-fbf54a170a43","year":2020},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.070932Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:346bceab210db0a238b9ca22da01084b6d23b2d5422f62d8c46efe0aaddfc7b2","observation_id":"72c22915-a4e3-4391-bb47-0278829a0b8b","resolution":{"observed_at":"2026-08-06T14:52:43.922358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-09T23:04:15.431743Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-06T14:52:43.074970Z","title":"High-dimensional continuous control using generalized advantage estimation.arXiv preprint arXiv:1506.02438 , 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.074970Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:0653bd8bca7e346ffd90858a910f2c3e7c66c7602e626e46cf23c60c39fe074d","observation_id":"0ab1f9ef-b262-4e48-b6c3-f8f007dccfb6","resolution":{"observed_at":"2026-08-06T14:52:43.074970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T14:52:43.078846Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.078846Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:418822e3ce8b1de9a9d8c88a7dda05ad2be42f398efd320a7748aba16446ee33","observation_id":"b8811d1d-f7a1-4bd5-b48f-a4d2e1ce2f18","resolution":{"observed_at":"2026-08-06T14:52:43.078846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.082564Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.082564Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:be886ab2b3d088b7d34892053a6f7da924152e64dc4b89e85d21fc3510439153","observation_id":"c5ebdd8f-cf34-4532-9ff4-43e16534c42a","resolution":{"observed_at":"2026-08-06T14:52:43.082564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.04696","last_updated":"2020-05-21T16:53:47Z","snapshot_observed_at":"2026-08-10T19:14:01.245716Z","submitted_at":"2020-04-09T17:26:52Z","title":"BLEURT: Learning Robust Metrics for Text Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.04696","snapshot_observed_at":"2026-08-06T14:52:43.086257Z","title":"Bleurt: Learning robust metrics for text generation.arXiv preprint arXiv:2004.04696, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.086257Z"},"links":{"cited_paper":"/paper/2004.04696","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:103ee68e28e0e521cca1a4e3a6d01de09b6379cb2d52c8242f223ed1e032b28e","observation_id":"f2ea7918-8e3f-4ba1-b3bb-08b825cf6a36","resolution":{"observed_at":"2026-08-06T14:52:43.086257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.901040Z","title":"Multi-turn reinforcement learning with preference human feedback.Advances in Neural Information Processing Systems , 37:118953–118993, 2024","venue":null,"work_id":"3f1b4da3-51f8-42d6-8b34-3e40b6ba5aaf","year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.090179Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:b76158088d7fa4d99f2b0d7757e93ca09de52c8d7ce01563fb34421d00ce999e","observation_id":"89a7f05a-07a9-4695-93da-432ce8651a61","resolution":{"observed_at":"2026-08-06T14:52:43.906761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13289","last_updated":"2024-04-08T06:12:52Z","snapshot_observed_at":"2026-08-02T21:51:36.809095Z","submitted_at":"2023-10-20T05:41:57Z","title":"SALMONN: Towards Generic Hearing Abilities for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13289","snapshot_observed_at":"2026-08-06T14:52:43.093912Z","title":"Salmonn: Towards generic hearing abilities for large language models.arXiv preprint arXiv:2310.13289 , 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.093912Z"},"links":{"cited_paper":"/paper/2310.13289","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:aec7cabd1d64c36117acf165d9fe50b091dcc638e4f9fbeae4f5343c04f714d4","observation_id":"f8ed3eba-780c-40fd-807e-8d08b3627989","resolution":{"observed_at":"2026-08-06T14:52:43.093912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.04672","last_updated":"2022-08-25T17:10:53Z","snapshot_observed_at":"2026-07-06T13:29:47.927628Z","submitted_at":"2022-07-11T07:33:36Z","title":"No Language Left Behind: Scaling Human-Centered Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.04672","snapshot_observed_at":"2026-08-06T14:52:43.097821Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.097821Z"},"links":{"cited_paper":"/paper/2207.04672","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:7460b8825fce7b1778cba4f8d49a7699b3645d792016cd856149830c753c08b0","observation_id":"97446e09-493b-4c3c-aec1-cdec8c534c2f","resolution":{"observed_at":"2026-08-06T14:52:43.097821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.886512Z","title":"Attention is all you need.Advances in neural information processing systems , 30, 2017","venue":null,"work_id":"f95627d5-1464-44fc-b526-3d036e91b4cd","year":2017},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.101738Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:861a7f8c2631aa69fcaa54a327ad75b674842f7e9300419790a18004d4c1babc","observation_id":"59b61e76-417b-4c6a-b5d0-c1356ccbb20e","resolution":{"observed_at":"2026-08-06T14:52:43.891363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:43.869924Z","title":"Barriers to effective evaluation of simultaneous interpretation","venue":null,"work_id":"65dcedcb-1e0f-4b16-ab13-72fdf789b506","year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.105453Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:542fe5134dc1eaae4e6fdedd651d17a0bc514cda993bb2317228cdb0edbbbe03","observation_id":"6e6c82a1-9e10-4451-ab68-082606b759c0","resolution":{"observed_at":"2026-08-06T14:52:43.876379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1609.08144","last_updated":"2016-10-08T19:10:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-09-26T19:59:55Z","title":"Google's Neural Machine Translation System: Bridging the Gap between Human and Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.08144","snapshot_observed_at":"2026-08-06T14:52:43.109032Z","title":"Google’s neural machine translation system: Bridging the gap between human and machine translation.arXiv preprint arXiv:1609.08144 , 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.109032Z"},"links":{"cited_paper":"/paper/1609.08144","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:5c600b546aa0d10b98d4548c150209294418175115cf8b96198614390efee04c","observation_id":"1d370ecd-37b2-438b-a7b6-735eebc40dd4","resolution":{"observed_at":"2026-08-06T14:52:43.109032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.11525","last_updated":"2024-02-27T17:12:38Z","snapshot_observed_at":"2026-08-11T01:37:59.202229Z","submitted_at":"2024-02-18T09:51:49Z","title":"Advancing Translation Preference Modeling with RLHF: A Step Towards Cost-Effective Solution","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.11525","snapshot_observed_at":"2026-08-06T14:52:43.112966Z","title":"Advancing translation preference modeling with rlhf: A step towards cost-effective solution.arXiv preprint arXiv:2402.11525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.112966Z"},"links":{"cited_paper":"/paper/2402.11525","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:3c5b663fbff361603c472c1739301bbd825902998c109d80091f358d9d5f0c85","observation_id":"0ab56493-b3e5-4e9a-9c8c-4c155245f544","resolution":{"observed_at":"2026-08-06T14:52:43.112966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20622","last_updated":"2025-05-27T01:59:58Z","snapshot_observed_at":"2026-08-11T02:52:53.916057Z","submitted_at":"2025-05-27T01:59:58Z","title":"SeqPO-SiMT: Sequential Policy Optimization for Simultaneous Machine Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20622","snapshot_observed_at":"2026-08-06T14:52:43.116694Z","title":"Seqpo-simt: Sequential policy optimization for simultaneous machine translation.arXiv preprint arXiv:2505.20622 , 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.116694Z"},"links":{"cited_paper":"/paper/2505.20622","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:d08982ae74b4c2c022c580014048939338d954e84944ff24b58e13761085b85b","observation_id":"c651d8ec-d287-47d1-b108-9346a5d1c24a","resolution":{"observed_at":"2026-08-06T14:52:43.116694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00634","last_updated":"2025-02-05T12:36:08Z","snapshot_observed_at":"2026-08-10T21:55:14.885695Z","submitted_at":"2025-02-02T02:47:09Z","title":"SimulPL: Aligning Human Preferences in Simultaneous Machine Translation","version":2},"cited_work":{"arxiv_id":"2502.00634","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.00634","snapshot_observed_at":"2026-08-06T14:52:43.261800Z","title":"SimulPL: Aligning Human Preferences in Simultaneous Machine Translation","venue":"cs.CL","work_id":"4cc0b646-8976-474a-86fe-f23384c37c98","year":2025},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.120451Z"},"links":{"cited_paper":"/paper/2502.00634","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:2de707b069196e332537f83ce462949f9d106c312c3389093298c92778aebaa2","observation_id":"31466a44-50f8-4ad4-9fb4-53d8da3e18ec","resolution":{"observed_at":"2026-08-06T14:52:43.266647Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04833","last_updated":"2021-06-09T06:35:46Z","snapshot_observed_at":"2026-07-06T11:17:24.552353Z","submitted_at":"2021-06-09T06:35:46Z","title":"RealTranS: End-to-End Simultaneous Speech Translation with Convolutional Weighted-Shrinking Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04833","snapshot_observed_at":"2026-08-06T14:52:43.124266Z","title":"Realtrans: End-to-end simultaneous speech translation with convolutional weighted-shrinking transformer.arXiv preprint arXiv:2106.04833 , 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.124266Z"},"links":{"cited_paper":"/paper/2106.04833","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:da19a3468776a1cf4fde0944faa3a91ec8507646bfa1ea76e634262d696f54b4","observation_id":"89c8ec39-435b-4021-b6e4-c93ada40b21c","resolution":{"observed_at":"2026-08-06T14:52:43.124266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00257","last_updated":"2023-03-01T06:28:33Z","snapshot_observed_at":"2026-08-05T18:32:15.815857Z","submitted_at":"2023-03-01T06:28:33Z","title":"Hidden Markov Transformer for Simultaneous Machine Translation","version":1},"cited_work":{"arxiv_id":"2303.00257","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.00257","snapshot_observed_at":"2026-08-06T14:52:43.227718Z","title":"Hidden Markov Transformer for Simultaneous Machine Translation","venue":"cs.CL","work_id":"10c878fe-a82a-42d0-b403-309f2fbb226d","year":2023},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.128024Z"},"links":{"cited_paper":"/paper/2303.00257","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:ecd6402b79a4f1b49e6974c3804238a795ea81f5cd767337cfc196fc3701ae47","observation_id":"96d01c85-cc23-4d41-a570-af79f0694837","resolution":{"observed_at":"2026-08-06T14:52:43.232284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03049","last_updated":"2024-06-05T08:24:22Z","snapshot_observed_at":"2026-08-03T15:25:01.058662Z","submitted_at":"2024-06-05T08:24:22Z","title":"StreamSpeech: Simultaneous Speech-to-Speech Translation with Multi-task Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03049","snapshot_observed_at":"2026-08-06T14:52:43.131946Z","title":"Streamspeech: Simultaneous speech-to-speech translation with multi-task learning.arXiv preprint arXiv:2406.03049 , 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.131946Z"},"links":{"cited_paper":"/paper/2406.03049","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:aa611e1f06fb475555c572ce8b9e86848d151af50c9c883d3b319ee52210bad0","observation_id":"03badae3-20c9-44ba-9f51-72e48a20afb8","resolution":{"observed_at":"2026-08-06T14:52:43.131946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1909.01559","last_updated":"2019-09-12T01:19:12Z","snapshot_observed_at":"2026-08-09T14:34:57.232182Z","submitted_at":"2019-09-04T05:37:36Z","title":"Simpler and Faster Learning of Adaptive Policies for Simultaneous Translation","version":2},"cited_work":{"arxiv_id":"1909.01559","doi":null,"metadata_source":"pith","pith_arxiv_id":"1909.01559","snapshot_observed_at":"2026-08-06T14:52:43.190405Z","title":"Simpler and Faster Learning of Adaptive Policies for Simultaneous Translation","venue":"cs.CL","work_id":"cb44fbd3-1b8b-4de9-b98e-63c9fdb800c4","year":2019},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.136212Z"},"links":{"cited_paper":"/paper/1909.01559","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:ab8b83aacda4690c12c3638a20c84769339a691e3b7b850a4ee66df18e52fb97","observation_id":"e95bcf2c-1ce5-4cb3-8388-3ebdfa03033d","resolution":{"observed_at":"2026-08-06T14:52:43.196815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-11T04:34:07.318549Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-06T14:52:43.139901Z","title":"Fine-tuning language models from human preferences.arXiv preprint arXiv:1909.08593 , 2019","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:43.139901Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:fb33487eed587d70842baa3d894cc1209f4ecd8dee469600a61189151edae9a8","observation_id":"6beb526e-ea6a-4b8f-a1e9-ec790b2024c7","resolution":{"observed_at":"2026-08-06T14:52:43.139901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:52:44.006110Z","title":null,"venue":null,"work_id":"0c65af90-2e9f-47a9-a788-2f50b96145e4","year":2023},"citing_paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T14:52:42.984293Z"},"links":{"citing_paper":"/paper/2507.17527"},"observation_digest":"sha256:2d0566d05abcc8947fb5def6f023b346fe9cd40140e07dccfc9d2730cc9a94f7","observation_id":"1f683933-5a1b-4bb0-8f87-169788815496","resolution":{"observed_at":"2026-08-06T14:52:44.010929Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17527","last_updated":"2025-07-27T05:17:25Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T10:18:26.773169Z","submitted_at":"2025-07-23T14:07:41Z","title":"Seed LiveInterpret 2.0: End-to-end Simultaneous Speech-to-speech Translation with Your Voice"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":10,"verified_fuzzy":9},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 5 inbound Pith citation observations for arXiv:2507.17527."}