{"as_of":"2026-08-15T15:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:187b1fad3dabd7f00b3fbae0697393d9baff60b02fefbfa73cb0fe0698ab01d6","coverage":[{"denominator":300,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:43:06.168514Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.19810/citation-record","integrity":"/paper/2607.19810/integrity","json":"/paper/2607.19810/citation-record.json","paper":"/paper/2607.19810"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:03.819891Z","title":"Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:03.819891Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:eb70b761f12ed7ba82b9ab18389e287e9ea4b849494b14089a4a443fdbae5b90","observation_id":"7348cb73-ad39-4df5-b47f-d149b7450113","resolution":{"observed_at":"2026-08-01T11:43:03.819891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.001640Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.001640Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:b7ae4502a4b0ab6558459180a5bd8808ab7799d1727aad48770c0b81709699eb","observation_id":"2a7e13cc-f32d-4adc-a8c0-8aff9e1bf1a7","resolution":{"observed_at":"2026-08-01T11:43:04.001640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.178586Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.178586Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:fb0933a0b987b97d5577ec4015a40d4a79526455f68270f981fd9ec261b8e763","observation_id":"9acdf087-c2f3-4f29-9935-b0843ee69047","resolution":{"observed_at":"2026-08-01T11:43:04.178586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.236069Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.236069Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:e8ae2e18dad31ed8ab96f5087f0c35e281844f0feca109b6fc91d85041d3e7f8","observation_id":"aa477866-c4e8-4a94-a060-4da77426a334","resolution":{"observed_at":"2026-08-01T11:43:04.236069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.302056Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.302056Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:91dfb7771edf0a9d2d9b4d6a9c1ddf59ad9e0b3d201699afb60857a5ee5f1221","observation_id":"f5c05d41-16c7-452b-a510-c8a114ad4a4c","resolution":{"observed_at":"2026-08-01T11:43:04.302056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.364399Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.364399Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:7e777d6df69901654faaa74d408c1db179c5fd04a09bc1aadf1368005de53def","observation_id":"679745b6-f256-46ea-9075-be703106f485","resolution":{"observed_at":"2026-08-01T11:43:04.364399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.430644Z","title":"ACM Computing Surveys , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.430644Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:1837a10c23afba346f629e0a4b3106dbed33ac13dfa0ca188d4f6a2a50967c58","observation_id":"e32e7465-ad96-4981-83fe-16901ab61658","resolution":{"observed_at":"2026-08-01T11:43:04.430644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.488822Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.488822Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:d0ffa348fc3683e76699b9e919814a5c6d7a0f1cc35412d7636cb94567881b50","observation_id":"7ec832b5-8c49-4a43-9cdf-726617057f3d","resolution":{"observed_at":"2026-08-01T11:43:04.488822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.552378Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.552378Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:5150788fbcfbce2aa8e3a1e0acb78bcb88e114d6a53ba407aa303c952ec7058c","observation_id":"28c90351-d0ed-4e21-8232-26acfc2615bf","resolution":{"observed_at":"2026-08-01T11:43:04.552378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.611478Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.611478Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:0dac5067708ed7399999904db35e3dcfe1e59602c8cbdcd001467935dcb8b88a","observation_id":"61448e3a-462d-4a29-895c-c0fad599d4b0","resolution":{"observed_at":"2026-08-01T11:43:04.611478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.681732Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.681732Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:3a43679fce628a13d2a82c2e5cead0fba43180f96f4b4268aa3fc4637cc3d17f","observation_id":"9cd48e4a-b268-4150-a524-766a23344a60","resolution":{"observed_at":"2026-08-01T11:43:04.681732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.767176Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.767176Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:a97fa9afd61139e642385f13565240c9f925dd0f238b697b3d74d17b801b9e03","observation_id":"02fd3256-b4f9-4efe-98df-137f56d027c5","resolution":{"observed_at":"2026-08-01T11:43:04.767176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.825659Z","title":"Soong and Tao Qin and Sheng Zhao and Tie-Yan Liu , journal=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.825659Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:bdd9c5443a1bb188b1eeb8827f3c101100ebd9a50745f81d7a30c3550cd10138","observation_id":"65efc3c1-ae2f-4f4f-8a17-44a0fbeb30c3","resolution":{"observed_at":"2026-08-01T11:43:04.825659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:04.889182Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:04.889182Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:650759fbd8e19fc01d76089bb076f58ff4bdd0aedba887ff8bdb788301217a23","observation_id":"560082c0-9e66-47bf-b4b4-e303967bb066","resolution":{"observed_at":"2026-08-01T11:43:04.889182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.019755Z","title":"International Conference on Language Resources and Evaluation , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.019755Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:4b6a2550a078235dd81f480594e977478463a44789e093c46fa790386c31733a","observation_id":"d523d73f-a0d8-4d98-9cb5-ec963721cc50","resolution":{"observed_at":"2026-08-01T11:43:05.019755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.123226Z","title":"International Conference on Acoustics, Speech and Signal Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.123226Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:73e4e9953050883904c69ad033228d68ef40cbe0720c0f45f41e57729d2b0854","observation_id":"5e78dcdf-dc38-4fed-969c-58b6a5d899e3","resolution":{"observed_at":"2026-08-01T11:43:05.123226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.267567Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.267567Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:a8675c5beb237c6ddf47f6d2110b9a8086cd11b56811cb9d4402cc3cd7fcc307","observation_id":"9b64820c-8ea4-45bd-a504-6d4d8127a966","resolution":{"observed_at":"2026-08-01T11:43:05.267567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.415269Z","title":"Conference on Empirical Methods in Natural Language Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.415269Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:b0e79243d0d6dcab3eed8a86547f2cade87a31b9aa79a721a04b7052c157e495","observation_id":"d24555fb-390d-45ec-9106-80bf9b13c9df","resolution":{"observed_at":"2026-08-01T11:43:05.415269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.580645Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.580645Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:789952ef0f7e619386467ba7daf09255dc57f4d4facfe19bba93ab6cfa851004","observation_id":"1359c5fa-3fc0-4155-83da-bee89689b68c","resolution":{"observed_at":"2026-08-01T11:43:05.580645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.590435Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.590435Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:449e1a8fb308b0b53404f531a111895dd347372513cc665910e4b0fd3e94b9d6","observation_id":"e0832698-b875-472a-a033-3b896d5cdd79","resolution":{"observed_at":"2026-08-01T11:43:05.590435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.698342Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.698342Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:a787b31706a365f456d6cb717aaa94b641397b21059ed0df15652e9f64899144","observation_id":"8d21270b-6511-4d91-b9a6-1f973968ca33","resolution":{"observed_at":"2026-08-01T11:43:05.698342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.721971Z","title":"Advances in Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.721971Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:c5a5d38643cc2bdda0d48267cddd1b2ea2ebf0c8b7334547ac2842fd9a0091d4","observation_id":"67626556-789b-48f6-a7ee-a6a20f80126d","resolution":{"observed_at":"2026-08-01T11:43:05.721971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.729348Z","title":"International Conference on Acoustics, Speech and Signal Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.729348Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:b93e03d18540a3329cfd40450c48a7fc06bab5b5c316b904e4c943f6d1611636","observation_id":"f12f2a6e-399e-4353-9793-cfceee3b02c7","resolution":{"observed_at":"2026-08-01T11:43:05.729348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.734401Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.734401Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:566a003589181431167b55ab260422cc2f5b1d2d794d6db24ca75d2f53c5bb0b","observation_id":"c2092b26-7739-43ed-8c5c-d958e0160689","resolution":{"observed_at":"2026-08-01T11:43:05.734401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.739539Z","title":"Kameoka and Takuhiro Kaneko and Kou Tanaka and Nobukatsu Hojo , journal=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.739539Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:b3f81b68cd1070f76101a10381ad70a75ef4602944a29fbfb005000f2e98fd17","observation_id":"a3213cf1-c1d2-4911-b8ce-b1b391bb08ff","resolution":{"observed_at":"2026-08-01T11:43:05.739539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.743917Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.743917Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:a713c02d51fd49d06ba2db5429721abf0478689c3a83057749cd0c05ca7b3f33","observation_id":"53497f18-be58-4808-bcdd-298b3dd9f198","resolution":{"observed_at":"2026-08-01T11:43:05.743917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.749661Z","title":"Sequence-to-sequence modelling of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.749661Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:439172d0590a935fa93f6e129dab5d95dfcf2661620f96718331f3d14ea0e367","observation_id":"b8483564-a998-4dea-b12d-d15fe298ba5a","resolution":{"observed_at":"2026-08-01T11:43:05.749661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.754219Z","title":"Proceedings of the 2022 Conference on Empirical Methods in Natural Language Processing , year=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.754219Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:237afdbf46236325235848bc1772437115fdd4420fa02c5d38b9c2955c0b568c","observation_id":"c239a233-23f6-4fac-8843-6c4cedfffd54","resolution":{"observed_at":"2026-08-01T11:43:05.754219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.759719Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , volume=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.759719Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:8811feb2c05b4320172216da059f21e0c51d51f51eb56a503d2eddfc9620840d","observation_id":"b752e4f8-c2e5-4d45-b636-4f005f34687a","resolution":{"observed_at":"2026-08-01T11:43:05.759719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.765250Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.765250Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:d510ab129839ed4a6cade220eedb07cb1207f96a4b9a18edcc22b9808ba7c060","observation_id":"906ce6be-bf4a-4b6d-804c-462b408f773a","resolution":{"observed_at":"2026-08-01T11:43:05.765250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.769791Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.769791Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:2a0807afc6f1a2b794ba01dbe935380d56c452cb2b50058b12046bafb03caebf","observation_id":"40d4daf7-f319-46a7-908d-87268dc606cd","resolution":{"observed_at":"2026-08-01T11:43:05.769791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.774495Z","title":"Advances in neural information processing systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.774495Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:b8c4080dfd407a6f208769db7b42bf283743da2a4f23099aee33f3f49258c563","observation_id":"bab14154-a352-48d0-8478-c4455a3ad2f0","resolution":{"observed_at":"2026-08-01T11:43:05.774495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.784799Z","title":"International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.784799Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:ea0c7e87208cf5cd94a1b9ed5cefce2a98f7ce86ab48ca11256f2569abaec78d","observation_id":"b9c07824-94b5-4631-9f07-6e488325fdfd","resolution":{"observed_at":"2026-08-01T11:43:05.784799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.790158Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.790158Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:de0767b5a513e449a8972b803c8243685b3b6479e190462c070c9a8b8d351052","observation_id":"28694c2d-2014-4fac-8132-5df65bba339a","resolution":{"observed_at":"2026-08-01T11:43:05.790158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.796043Z","title":"Weiss and Mike Schuster and Navdeep Jaitly and Zongheng Yang and Z","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.796043Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:e11a6c2f23f77308ae449a6ee4232523bbc6bf5736420de8ba3136e596180de7","observation_id":"fae1025d-d752-45fb-a298-c484c4ad302e","resolution":{"observed_at":"2026-08-01T11:43:05.796043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.800744Z","title":"Transactions of the Association for Computational Linguistics , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.800744Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:510e483a92a3cbeeeb19f037ea28a3c3bff8cbdf41d892958caa254e4fab33d0","observation_id":"8ab8a5b2-7590-47e3-9527-ae682621dc46","resolution":{"observed_at":"2026-08-01T11:43:05.800744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.806607Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.806607Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:1c8597b91dbbd60d4701ef5f55f1608b4c17c9436764dcc3e547231a31b0ddb5","observation_id":"c8e75b5f-ecea-4cd9-8420-704a79e19608","resolution":{"observed_at":"2026-08-01T11:43:05.806607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.811416Z","title":"Interspeech , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.811416Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:290bc5126758fb6ea55aeae7d34df1f3749b61a3b19eb853f143094b6555676f","observation_id":"fde9b8b0-efa0-45f3-aa41-e171a67aa40e","resolution":{"observed_at":"2026-08-01T11:43:05.811416Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.816859Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.816859Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:0620f7c186ed5ba870177dc61ba1cbc817757354e777c247fd9ae6005ef42dab","observation_id":"1d878ffd-5f7f-4455-b625-1e8460ed1beb","resolution":{"observed_at":"2026-08-01T11:43:05.816859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.823395Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.823395Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:e6424743a71539cf21fd190ab26c07e2c36b2c100c4a8ac745669fccf7ad4dd8","observation_id":"c7c02d7f-d128-4f08-897c-1970d7d76d5f","resolution":{"observed_at":"2026-08-01T11:43:05.823395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.830069Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.830069Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:ad50c909b1a23861b9fa1d592a43bbcf5c49e43bd74f891eee9e55357a3a033b","observation_id":"873d6c3f-470b-4d46-a227-7cd73a19fa8e","resolution":{"observed_at":"2026-08-01T11:43:05.830069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.834732Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.834732Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:920f4f946cf3e9cd88937fb19a5b7a7585f9eab38739222ee35fb1c0828bf46f","observation_id":"b25ac47e-eb2d-4640-bf52-15fdd3d47138","resolution":{"observed_at":"2026-08-01T11:43:05.834732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.840301Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.840301Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:6509e0cec8b417daf1bb12cdfb18de849b764939d5fb393954c12a685c864cd6","observation_id":"a0255569-c3b5-4554-ae45-eb1fefe6a9a6","resolution":{"observed_at":"2026-08-01T11:43:05.840301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.845997Z","title":"Annual Meeting of the Association for Computational Linguistics , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.845997Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:d1c67f2c05ed48db9c75d127780e5cca4cdbc0aae3a39283e4d7f3d9a2f4fc58","observation_id":"7f409693-1b4f-4278-8b2c-795fefbf551a","resolution":{"observed_at":"2026-08-01T11:43:05.845997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.853572Z","title":"Transactions of the Association for Computational Linguistics , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.853572Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:6b78e0eeb54ff027e4dc332f555ed1174617b43ec6fca075bafbcaf43e65fc38","observation_id":"9f3f5c99-edc1-4e2e-9d67-d1803362ab1d","resolution":{"observed_at":"2026-08-01T11:43:05.853572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.861174Z","title":"Interspeech , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.861174Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:1e95bb8cdf49a7e94219db8cb74aca2072ae15539d8b7346a1373803bef038cb","observation_id":"df151d50-a7aa-4993-8c6b-d7a147d83052","resolution":{"observed_at":"2026-08-01T11:43:05.861174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.870117Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.870117Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:0821d29ce5ce996db4f0fab42cf5645d3c829373cc9f191e2ec6038c04337eaf","observation_id":"6f690248-b82b-48a0-9d66-74635bd50be9","resolution":{"observed_at":"2026-08-01T11:43:05.870117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.875782Z","title":"ArXiv , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.875782Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:d2984c697c0a35fe3ffd7942f33c9afe394155f7bd079ea72a090da9c1b850fe","observation_id":"d87c6820-e9e4-4628-9b70-f3af5b5a256c","resolution":{"observed_at":"2026-08-01T11:43:05.875782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.884151Z","title":"CoRR , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.884151Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:3b35d3f3ffe698d72ef0da2e5c03d32d6afe3b17dd76412803aa36b748de23e1","observation_id":"642b1c7d-645a-4322-9bf9-6dc00aea0223","resolution":{"observed_at":"2026-08-01T11:43:05.884151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.891747Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.891747Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:90453b0101b64babc1bc0d9ccafd28218e92b8cc34d280740522a7bf9a006e68","observation_id":"93d3ed7f-5589-4319-831a-134cd161820e","resolution":{"observed_at":"2026-08-01T11:43:05.891747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.897408Z","title":"Journal of Computational and Applied Mathematics , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.897408Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:2651b30f54016d3d5829c4e0bcdf57264b274afcdce69be34a52a5d00afcd219","observation_id":"aa9c5ded-932b-4904-a010-0fda4eb39f72","resolution":{"observed_at":"2026-08-01T11:43:05.897408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.903049Z","title":"International Conference on Acoustics, Speech and Signal Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.903049Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:5b4aef71c39e7d73dd5ccaf993f2c791955947b3e0e110e52e0962706fd8067f","observation_id":"3f845468-db9d-4a70-bc7a-a2dae7ed035e","resolution":{"observed_at":"2026-08-01T11:43:05.903049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.908555Z","title":"ACM SIGGRAPH 2022 Conference Proceedings , year=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.908555Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:0315a82c8b0f17a45f3b80ef5719b3a13d8b5de517f9f4ae8618100d9b93e556","observation_id":"8904258e-dca4-4d93-b189-d7b51f24a21f","resolution":{"observed_at":"2026-08-01T11:43:05.908555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.915232Z","title":"International Conference on Acoustics, Speech and Signal Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.915232Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:e93171f16f846ecba28acd6dcddbeeaed130d91fd7d8877a6ca2c01e6697c769","observation_id":"6de26944-764e-4771-a087-9f13b4057e1a","resolution":{"observed_at":"2026-08-01T11:43:05.915232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.920169Z","title":"Proceedings of IEEE pacific rim conference on communications computers and signal processing , volume=","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.920169Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:9815a615776dc869ef190dff180b2ad2fd0ddecb28e9e39124080ab7804343a3","observation_id":"261cd08a-a67c-4335-9240-ac6f3c433be3","resolution":{"observed_at":"2026-08-01T11:43:05.920169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.924979Z","title":"international conference on machine learning , pages=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.924979Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:ef0b7c12f2d01b86ddd0b8f3a0275cb1e8220a0770d6f4bbadf42e020ed947e1","observation_id":"0e5045b8-154f-43d4-b4ca-1cf702e42e44","resolution":{"observed_at":"2026-08-01T11:43:05.924979Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.930038Z","title":"ICASSP 2019-2019 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.930038Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:cc7f4f020c155b724466363f25758baa4d4eb14753f5a3b250abbcb7c70101a6","observation_id":"37709404-fd51-4f3a-b00e-c7bf8513418b","resolution":{"observed_at":"2026-08-01T11:43:05.930038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-14T16:51:22.656133Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-01T11:43:05.934717Z","title":"arXiv preprint arXiv:1904.02882 , year=","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.934717Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:49eca615fae12f5478a0042fb64be41187748fa0ff3709346067d1f6e333c503","observation_id":"5bede1a6-8c23-46ca-9340-f7e9b6c02d29","resolution":{"observed_at":"2026-08-01T11:43:05.934717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.940572Z","title":"Language Resources and Evaluation , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.940572Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:30c2b1aadac8b31ef19928c25603ab994d7ceaf5416509af319ce72119424640","observation_id":"71c52da8-d279-46b8-b724-4972b65422c0","resolution":{"observed_at":"2026-08-01T11:43:05.940572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-15T15:15:20.439536Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-01T11:43:05.944756Z","title":"arXiv preprint arXiv:2005.08100 , year=","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.944756Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:2245b6f9e34b9da4b7732d7a895d8d9659d894a9b24299150f16c9296ef6b53e","observation_id":"65daf81b-d5ff-494f-95cc-63834359f14f","resolution":{"observed_at":"2026-08-01T11:43:05.944756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.951534Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.951534Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:03db40e24c2036d394ffc7b3f947fe56d1a248e32fc5a51fbb4fccfa4c9b2215","observation_id":"961453c1-0ac5-4569-a91a-25579fa62a2d","resolution":{"observed_at":"2026-08-01T11:43:05.951534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.956341Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.956341Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:f3bdf6ac1f6f352599d4baa6c5f7c6a1cbb5e26ac9cdf0714379726bfd792da4","observation_id":"3b13ab9d-bbc0-46ae-b950-bcd82f36254f","resolution":{"observed_at":"2026-08-01T11:43:05.956341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.965371Z","title":"Interspeech , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.965371Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:513551c03e14a7c8fb98f50bd79ec50097962a200e26872c4f055d13c77e3d56","observation_id":"9b224ee2-e8e4-4d08-8b56-9b93b5d5fe3b","resolution":{"observed_at":"2026-08-01T11:43:05.965371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.970437Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.970437Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:68db327e1fa544df77f37c5441cae03b2dd74276031e3b2e41022e0c1ca4fef3","observation_id":"9368e0f9-2c31-40da-b24d-8e6054b19e0a","resolution":{"observed_at":"2026-08-01T11:43:05.970437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-01T11:43:05.975336Z","title":"arXiv preprint arXiv:2207.12598 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.975336Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:eaea4ee7c1ab19d8cfbd5e34919e89661c69cdc8391d29d954ea279e2d369c4c","observation_id":"e7e5542b-7af6-4532-8517-04397f66d58e","resolution":{"observed_at":"2026-08-01T11:43:05.975336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.981243Z","title":"Diffusion models beat","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.981243Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:7bdec01f6e7f94106242f4cd996228094716ddab68ecb192d99989c4a05b0176","observation_id":"3edc005b-f607-41ca-a43e-5d596434ff16","resolution":{"observed_at":"2026-08-01T11:43:05.981243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.11096","last_updated":"2019-02-25T21:32:06Z","snapshot_observed_at":"2026-07-06T07:04:57.275371Z","submitted_at":"2018-09-28T15:38:49Z","title":"Large Scale GAN Training for High Fidelity Natural Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.11096","snapshot_observed_at":"2026-08-01T11:43:05.988026Z","title":"arXiv preprint arXiv:1809.11096 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.988026Z"},"links":{"cited_paper":"/paper/1809.11096","citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:c581748a5933ea1986a793480e70eebea2dbc2e05660e077c06ab64f9e038b94","observation_id":"3046b723-f811-4df4-8edc-d7be59e3060b","resolution":{"observed_at":"2026-08-01T11:43:05.988026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:05.994197Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:05.994197Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:6438f698eebfab2a4c4af009caeb954d0c103d694a05614890d4fe204541134a","observation_id":"b44f9dd5-f229-45cf-ae34-0e354c360bbc","resolution":{"observed_at":"2026-08-01T11:43:05.994197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.000470Z","title":"Advances in neural information processing systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.000470Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:73424c26d4390170efc000d08acb39676318b8401a47e8f71abc43ae5f320e40","observation_id":"88f0a0e0-e3d7-4f61-a340-b71c3b2d94b3","resolution":{"observed_at":"2026-08-01T11:43:06.000470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.006438Z","title":"Workshop on automatic speech recognition and understanding , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.006438Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:00e550667298b4fad44d5079ff491a61a2802b885c4be76de3b126f8d1f8e75b","observation_id":"bfecba2b-f698-443f-a96c-8b1218f44737","resolution":{"observed_at":"2026-08-01T11:43:06.006438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.012590Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.012590Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:cd945deaf4b7dfed73314f193f348fbb4b19cd5698d1fd46129d5c5054ab68d3","observation_id":"e532c97b-8e3f-4ff8-928e-090a37b6e1bb","resolution":{"observed_at":"2026-08-01T11:43:06.012590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.019530Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.019530Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:d032fc30863340c2f5bf45acdc910defca20cc0330391a06fa64620241d9a9e1","observation_id":"9b48cdaa-bf84-418c-8d02-e0e5053fd9f6","resolution":{"observed_at":"2026-08-01T11:43:06.019530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.024673Z","title":"Park and William Chan and Yu Zhang and Chung-Cheng Chiu and Barret Zoph and Ekin Dogus Cubuk and Quoc V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.024673Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:8ab2df3d3c84a0e5f46e97782df3f533a6b7d4ce97d8985e601d557eeffb4be4","observation_id":"37bf5dd0-880e-4ea5-87b4-9310605bca57","resolution":{"observed_at":"2026-08-01T11:43:06.024673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.029532Z","title":"Acoustics, Speech, and Signal Processing, IEEE International Conference on , volume=","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.029532Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:adac5a3447548b555f095861b11398fa2372407f84a922a653871f81810a59bc","observation_id":"880ed13c-38cb-4b08-b2c1-aed6fdb6b347","resolution":{"observed_at":"2026-08-01T11:43:06.029532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11377","last_updated":"2022-12-21T21:36:52Z","snapshot_observed_at":"2026-08-13T13:16:55.340729Z","submitted_at":"2022-12-21T21:36:52Z","title":"ReVISE: Self-Supervised Speech Resynthesis with Visual Input for Universal and Generalized Speech Enhancement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.11377","snapshot_observed_at":"2026-08-01T11:43:06.034148Z","title":"arXiv preprint arXiv:2212.11377 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.034148Z"},"links":{"cited_paper":"/paper/2212.11377","citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:3b5c8140c30e82d723fa70faf5f18e2b98dc6766b10659ff2332ddb68c5381a7","observation_id":"4c33081c-c3d4-4e17-b356-a76de0116eb9","resolution":{"observed_at":"2026-08-01T11:43:06.034148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.039154Z","title":"Proceedings of the IEEE/CVF International conference on computer vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.039154Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:f588e7d0d3616985ab8769624d245156817118b1cc1c7fbf6c562f530a76c881","observation_id":"6f212bf8-3583-4c51-85ce-d8ad7e481712","resolution":{"observed_at":"2026-08-01T11:43:06.039154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.044303Z","title":"Interspeech , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.044303Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:6e3f5de11630d68e49930b3315e3af85288e6775bf35c8afc9e68e72b22ee518","observation_id":"23d8f378-c07d-4c37-adf8-f44613a021a1","resolution":{"observed_at":"2026-08-01T11:43:06.044303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.049020Z","title":"IEEE Journal of Selected Topics in Signal Processing , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.049020Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:509ab5c318d2f8e7cfb93a3dba72ef2612e2d5fdc1f0174104789700f3fc301c","observation_id":"ab58b0a0-be91-4c22-93cb-96c587a88fc4","resolution":{"observed_at":"2026-08-01T11:43:06.049020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.053459Z","title":"Interspeech 2022, 23rd Annual Conference of the International Speech Communication Association, Incheon, Korea, 18-22 September 2022 , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.053459Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:9f0ff03844d944c5fad2726ce67a7ea38df7f19bd7a79e0a3fff8b207a08eb32","observation_id":"9813d0db-f883-48a0-bd85-67c56ba7ee6e","resolution":{"observed_at":"2026-08-01T11:43:06.053459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09116","last_updated":"2023-05-30T16:09:10Z","snapshot_observed_at":"2026-08-15T09:40:37.844367Z","submitted_at":"2023-04-18T16:31:59Z","title":"NaturalSpeech 2: Latent Diffusion Models are Natural and Zero-Shot Speech and Singing Synthesizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09116","snapshot_observed_at":"2026-08-01T11:43:06.058605Z","title":"arXiv preprint arXiv:2304.09116 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.058605Z"},"links":{"cited_paper":"/paper/2304.09116","citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:0c2c2b29a017c0fa596d6e8eee831fb6aa76e1a4b1114efeb47d6fffde7b9534","observation_id":"f91965fd-1d8d-4831-aa05-a7edb4019bbb","resolution":{"observed_at":"2026-08-01T11:43:06.058605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.063666Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.063666Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:6b2ec29feb469d2df065102e2b1a3fe9c731c9c2c7ec4557f6c2543e7c3e356b","observation_id":"4255a5c5-98ac-4157-b085-3109110a09ee","resolution":{"observed_at":"2026-08-01T11:43:06.063666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.068570Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.068570Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:8bdbd16034f2fdbf8acaf330ae5dbd39af4d61e78f3ac8688dfc3f95413ad9fb","observation_id":"d43c42c9-64e0-4930-8519-689a0e5323cc","resolution":{"observed_at":"2026-08-01T11:43:06.068570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.074002Z","title":"2023 , eprint =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.074002Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:c7621bc387a798468516a9969de4528434cfbc2bc64994deed95190fd9b5df31","observation_id":"ca6eda0c-c2bc-495e-ac5c-df4ee23701c4","resolution":{"observed_at":"2026-08-01T11:43:06.074002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.078975Z","title":"2017 , pages =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.078975Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:d22841b228d8d7845549abe7c9c548768e06ede9a0092fc2eb0e9f49a97f7a20","observation_id":"303b3103-726b-4b36-b5db-a4a30a0145f6","resolution":{"observed_at":"2026-08-01T11:43:06.078975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.085311Z","title":"Cooper and Michael K","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.085311Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:72670521f8349eba3a4176b7eb67b0ad5d58a3285619c0ad43236e9622eeef9a","observation_id":"09be16df-91d3-4775-a615-89bf54b3c49f","resolution":{"observed_at":"2026-08-01T11:43:06.085311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.091916Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.091916Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:240ebf29049209fc76475ef36673dcfd0895c8d1e06e79b8e67e01b8f3566b0b","observation_id":"96b85180-27c0-4fa6-a937-bf24bc7e207a","resolution":{"observed_at":"2026-08-01T11:43:06.091916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.099078Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.099078Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:35a97812798e5f3266bd1b384c8690ac4b79fd7dbca847ed2706a6d048a5aa76","observation_id":"f7ec0783-b3cd-4d52-924c-a81f9bc8d810","resolution":{"observed_at":"2026-08-01T11:43:06.099078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.104508Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.104508Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:acf88b283e1d06fee9c01ba684e91f789ec7f7e346a00d1138cb85067df33703","observation_id":"f80c416f-ebf4-450e-86b7-ba738d773487","resolution":{"observed_at":"2026-08-01T11:43:06.104508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.109174Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.109174Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:624d13358b219dea49a87ba0b65d05b07e5777462a2b1daa9074f72f22ba658f","observation_id":"24d040fd-17c0-4c33-890c-a660dac33b9c","resolution":{"observed_at":"2026-08-01T11:43:06.109174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.118868Z","title":"2022 , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.118868Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:8e89b2894db9626252ff1517f68467fd06c50f5677d41f0f2e038ca38f350890","observation_id":"a72e8d70-7cc8-4e31-8ab6-3278cb84248e","resolution":{"observed_at":"2026-08-01T11:43:06.118868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.123483Z","title":"2024 , eprint =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.123483Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:1043a5c078f041f150bd2383f21b5425fcc738fdd08f14bebb1665e0fbdff38c","observation_id":"5738dd00-0472-4a75-a656-463aa5fec383","resolution":{"observed_at":"2026-08-01T11:43:06.123483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.128148Z","title":"Goucher and Adam Perelman and Aditya Ramesh and Aidan Clark and AJ Ostrow and Akila Welihinda and others , title =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.128148Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:e4a558e652f685afbc740c4466ac6580658ee9b4af0dd96be502b69902fd0892","observation_id":"d78f9f8b-34dd-4449-842f-aea6a22254ee","resolution":{"observed_at":"2026-08-01T11:43:06.128148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.133128Z","title":"2023 , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.133128Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:ff48e263b300996fa8f499dda96e9fb8da66afab8fc26ec5fa56fd56e07928db","observation_id":"4645044b-8bbe-4bdb-b695-fbe421f0e349","resolution":{"observed_at":"2026-08-01T11:43:06.133128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.138296Z","title":"2022 , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.138296Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:75b08f1762c06e5fcdf8a86efde3300328d8b4270a4c6fddecdb5293442c6c0c","observation_id":"b508d856-3056-4088-bfd9-d65f2728ae36","resolution":{"observed_at":"2026-08-01T11:43:06.138296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.142663Z","title":"2022 , pages =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.142663Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:3507f79e2e5904c02b350dfde68d7e7d28bdcdc4aa9178e9354d352a08184ad8","observation_id":"a6ddddb1-2a5e-4c13-8709-115e43fbbb6f","resolution":{"observed_at":"2026-08-01T11:43:06.142663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.147905Z","title":"Weiss and Fadi Biadsy and Wolfgang Macherey and Melvin Johnson and Zhifeng Chen and Yonghui Wu , title =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.147905Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:ea7a07647d9577ace3bb485afe1bb6e50864c9ec66a9772525ed053da00151fc","observation_id":"752586ea-ee24-4032-865b-6f12ddb01938","resolution":{"observed_at":"2026-08-01T11:43:06.147905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.152579Z","title":"2023 , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.152579Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:12e0ce22c2e87a428161cbcdb6ac39e4d78ee9bfb041c405518a3ee0e544cacb","observation_id":"3c71b615-7bd2-4b31-9bd5-df54bee7cbec","resolution":{"observed_at":"2026-08-01T11:43:06.152579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.157552Z","title":"2023 , pages =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.157552Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:c158b7ebe13d35b88b126fa6d9f212259f4af516088b37b90d3c93ecb8beca21","observation_id":"9e2d35c2-cca9-415b-acb6-c5387f952202","resolution":{"observed_at":"2026-08-01T11:43:06.157552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.162866Z","title":"2025 , eprint =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.162866Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:b25a5d59884d2d41277c190f2f500d3504e95154d58b794a58e798ecf266df47","observation_id":"e8821b7b-0fe0-4c52-a351-83496e5a243b","resolution":{"observed_at":"2026-08-01T11:43:06.162866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:43:06.168514Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-01T11:43:06.168514Z"},"links":{"citing_paper":"/paper/2607.19810"},"observation_digest":"sha256:bdbafe9ed5909925bb6e2ddaa3cc050c6b34aa2f3a4813cc2c9b6ec36a03f44a","observation_id":"cc1ddbbf-731c-4e8f-92dc-73085efd95e8","resolution":{"observed_at":"2026-08-01T11:43:06.168514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19810","last_updated":"2026-07-22T06:42:20Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T23:49:52.327639Z","submitted_at":"2026-07-22T06:42:20Z","title":"SimulS2ST-Omni: Data-Efficient Streaming Speech-to-Speech Translation via Explicit Trajectory Supervision"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":99,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":300},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 300 outbound references and 0 inbound Pith citation observations for arXiv:2607.19810."}