{"as_of":"2026-08-08T08:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1bc27d37694c3dda50356862d93863683bb60661726a65af50eba2e49c4b4a1d","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:34:32.822198Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02157/citation-record","integrity":"/paper/2506.02157/integrity","json":"/paper/2506.02157/citation-record.json","paper":"/paper/2506.02157"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:41.584148Z","title":null,"venue":null,"work_id":"1ae75076-8a7a-40cb-aea1-7f071051e8e8","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.412666Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:2c7d26bbdd304c8870b69a18a743279595851bf906e5e9c50d4281914337ec7f","observation_id":"26ed49f5-db10-4597-bcc3-e21942e003ff","resolution":{"observed_at":"2026-08-07T11:34:41.667108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:41.431404Z","title":null,"venue":null,"work_id":"c2550cf5-3cfc-4710-a7f1-00db5204b180","year":2022},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.548590Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:ebcb58f33b65aaa8cad6ae532bb7439b24855a85a7e86a4675e1cd0ee37c6064","observation_id":"d17725f0-435a-4694-b730-7a123268ca4b","resolution":{"observed_at":"2026-08-07T11:34:41.509039Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:26.649216Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.649216Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:0973a29bba14c7db91332b24843e5344c4f389df2ec454f90dc5c475a90bc41d","observation_id":"0a6fd052-7c75-4da8-a177-e8bda0fb13cc","resolution":{"observed_at":"2026-08-07T11:34:26.649216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.84616","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:36.135833Z","title":null,"venue":null,"work_id":"22e5a7c0-2b1b-4808-85c0-fdb890c3167b","year":2018},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.800950Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:60d46a4bac04e88309d3782e474292a093eae065d19c33500f418311409dc161","observation_id":"890aab01-29fa-4468-a450-82f40e11902c","resolution":{"observed_at":"2026-08-07T11:34:36.255015Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:41.196952Z","title":null,"venue":null,"work_id":"57921b83-1831-43d7-ab48-7bc3838e46c3","year":2016},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.969017Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:524f2845bb48438b2102415c652628cad30b0a2267b377f672c8363b7c92f29b","observation_id":"a00928cc-c8e3-4a7c-ac49-86617499a18e","resolution":{"observed_at":"2026-08-07T11:34:41.278253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:41.029565Z","title":null,"venue":null,"work_id":"6fc839df-710d-4842-907b-5d8e8c4706d3","year":2005},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.091886Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:16863857f38284580cba773baaa95f892d6cb4c760d6edf16d0d0acef128d9bd","observation_id":"9c7ceccb-38ea-4ff9-97af-8aa812cc7041","resolution":{"observed_at":"2026-08-07T11:34:41.097461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.findings-acl.406","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:34.804360Z","title":null,"venue":null,"work_id":"55a194e8-3c3e-4798-84a0-594c526fd234","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.207491Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:a4498a5f813ccef56e4d9d24dcb8e2b770048cdb01de6027989b56fc6be2f166","observation_id":"bcec8312-4c12-4a05-8584-7de9839d97e6","resolution":{"observed_at":"2026-08-07T11:34:34.930332Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.915892Z","title":null,"venue":null,"work_id":"bd763722-ca30-4aa6-a003-9ba0eed5b6ef","year":2019},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.331246Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:a3342a9db8b768aef961ca568822b725877ea8f51dfe1f8f447fe6dac78a1b88","observation_id":"e45fb4db-de3e-496e-ae52-459aa4dd53f0","resolution":{"observed_at":"2026-08-07T11:34:40.961338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.naacl-main.151","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:34.502980Z","title":null,"venue":null,"work_id":"be3bbf5e-eb2d-4d69-9005-3498d01db789","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.477263Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:2d30561b58fb4acf07d0c01321cce1920ada9d9ae8d17282d4482ddf2e5e357a","observation_id":"4fea61ea-265e-4835-a6d1-31daeb585ec7","resolution":{"observed_at":"2026-08-07T11:34:34.628316Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.iwslt-1.8","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:34.226709Z","title":"Di Gangi, Matteo Negri, and Marco Turchi","venue":null,"work_id":"de7bdc88-f438-4de3-bca8-125598034004","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.597475Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:e7f07847bf82c05bd09e91e63000ed010da755fcf776d1beb0d0d7979c311d91","observation_id":"6b7c23d8-b848-4285-8e49-48c31e768746","resolution":{"observed_at":"2026-08-07T11:34:34.373801Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.757225Z","title":null,"venue":null,"work_id":"b112b30a-645b-49ee-a8cd-ca66af3bcf7a","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.761078Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:fed39263c36f7596da56a8c7d49a5a093d759c556d0f308d72ead64a43a1461c","observation_id":"ba96d074-9953-48da-ac38-645c9ce83e38","resolution":{"observed_at":"2026-08-07T11:34:40.816471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1211.3711","last_updated":"2012-11-14T19:25:21Z","snapshot_observed_at":"2026-07-06T02:59:58.238741Z","submitted_at":"2012-11-14T19:25:21Z","title":"Sequence Transduction with Recurrent Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1211.3711","snapshot_observed_at":"2026-08-07T11:34:27.886727Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.886727Z"},"links":{"cited_paper":"/paper/1211.3711","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:5496575e8c60433dc2d07ca704c5de26d103b99528cfa87165080f249bf6372c","observation_id":"527e90c5-3bad-4634-bff9-9309cc4275ad","resolution":{"observed_at":"2026-08-07T11:34:27.886727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:28.048968Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.048968Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:cc0660ebaef3bc9932ddd300f87f5fa8dd0ea52776fa834ecddc779cbec4519b","observation_id":"adfa8ec0-649e-46fc-837f-6f9413f577fb","resolution":{"observed_at":"2026-08-07T11:34:28.048968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.571809Z","title":null,"venue":null,"work_id":"46b8dec0-01b0-4f2d-8127-efe4989f396f","year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.172652Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:0d477b7983c42e6454745c539b57acbe2352737447264c09980fe4b30e5c396b","observation_id":"5a2eb57f-f3d9-432e-819f-04aaa3733481","resolution":{"observed_at":"2026-08-07T11:34:40.645382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.381471Z","title":null,"venue":null,"work_id":"3325d643-c661-45cc-9942-0f52139ec407","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.322877Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:0b2973554c91338c0af205d9af04843d4710c9b36ee7bf5caa4f5664a26a8ac4","observation_id":"04e9157e-cf0e-498e-a58f-de20cf20bc47","resolution":{"observed_at":"2026-08-07T11:34:40.456536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.227374Z","title":"o ksal and Nurcihan Y \\","venue":null,"work_id":"31347dd9-7c93-4a8f-8376-f1579d735699","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.498158Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:2d380e9a4211b87a45cfd55bcb3fd9f99d5e38a92197a03fe9cae7ef9727e76b","observation_id":"2a5cac74-bb1d-4beb-97b7-4cf36557b6ee","resolution":{"observed_at":"2026-08-07T11:34:40.290636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.090125Z","title":null,"venue":null,"work_id":"e074ca87-b8ef-4c4c-98d1-8c3602dfca88","year":2022},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.708235Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:278634fd3d011a47ec88dc84433ee7f9f93eddc740b37de49fe2418420416113","observation_id":"77a5ac04-0f77-469b-865b-e614425d1aee","resolution":{"observed_at":"2026-08-07T11:34:40.157384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:39.849956Z","title":null,"venue":null,"work_id":"74940326-d369-4d5a-950f-78d8ccdc664d","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.851151Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:bd9646984cd98b19d5defb8428f716a67fe00a86f124c0c4e39dc128f2f625e2","observation_id":"c94d20c3-1401-4d33-856a-015d09fcea7e","resolution":{"observed_at":"2026-08-07T11:34:39.972247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.aacl-main.58","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:33.978734Z","title":null,"venue":null,"work_id":"0bd2e84c-3049-4ced-84c1-337ad8f8017d","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.953691Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:74b08626a55df4361322954ecfb7841953166813258a9052824c33e883317a5e","observation_id":"1d176d17-581a-44da-8d8f-ba23822b9259","resolution":{"observed_at":"2026-08-07T11:34:34.061988Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:39.531285Z","title":null,"venue":null,"work_id":"cdc61d0a-68bc-4a2f-9ef6-13162f14ddb4","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.073222Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:c2e059249915079fada3670b4fb584c15436b43722d3f9d34977b579d1ebff9d","observation_id":"354d0581-58ce-4efc-b80d-f6c24f1c2730","resolution":{"observed_at":"2026-08-07T11:34:39.670490Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:39.324341Z","title":null,"venue":null,"work_id":"28f85de2-3e23-4be7-b965-9b589b738da0","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.192674Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:dcb7b777b6c5fbfde9d6cccdb69134a844afba52a64350e2aaa555f886a4f027","observation_id":"f1bb5c72-55f6-4bae-96b6-b2528b051d29","resolution":{"observed_at":"2026-08-07T11:34:39.410195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:29.317777Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.317777Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:c4997cb64a52a14c6d35d46ecb814e78c8c9677f173abd536eed0008febdcee3","observation_id":"f04753e2-bc24-42e3-864d-a06198f7a48f","resolution":{"observed_at":"2026-08-07T11:34:29.317777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:39.061032Z","title":null,"venue":null,"work_id":"891014bb-0940-4771-bf5a-3f2f6b31d613","year":2009},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.435674Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:c1339d68dab4c1323dd4e1385e3f852b8473462026e4f024abdde8b3f672e3d7","observation_id":"c92e6018-1930-41ed-8dca-1557496548a2","resolution":{"observed_at":"2026-08-07T11:34:39.141467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:29.649120Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.649120Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:7e42e72cf5432fc5c330d0bebaccc1273d3f1b8ad75424d4179e5653fb7ee623","observation_id":"29adc20c-6e24-4754-8f5e-23fdac6da86b","resolution":{"observed_at":"2026-08-07T11:34:29.649120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:38.758493Z","title":null,"venue":null,"work_id":"55940e89-378a-46dc-b79d-5a80cb1e5f8f","year":2019},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.033048Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:bbb842497f6f3ac937ed1e8c9b99b3404fb169e578de61541a2a83b3a950d9a5","observation_id":"44b23bfb-6996-45a0-bd4a-3f7a9974d44a","resolution":{"observed_at":"2026-08-07T11:34:38.869884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:38.436701Z","title":"McCarthy, and Deepak Gopinath","venue":null,"work_id":"edb44203-31ef-4b8c-a9a4-6fbeb783eb59","year":2019},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.219038Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:bdee897ce961d7a09ceb705b012ecad8fc09c4d046cc5e0497f575106b9ec973","observation_id":"bc39776e-1c00-4103-858b-17d7164a83c7","resolution":{"observed_at":"2026-08-07T11:34:38.572241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:38.167955Z","title":null,"venue":null,"work_id":"71151700-c8c7-416c-89e9-9fd8056659a3","year":2013},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.394588Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:934570b10750a27ee2921ead39040caa32d492117c83e0aa6704abe5fda9a071","observation_id":"cf1c812f-4d2c-4d25-8b7e-b3c8ff02dfb9","resolution":{"observed_at":"2026-08-07T11:34:38.294299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11010","last_updated":"2024-06-26T07:34:53Z","snapshot_observed_at":"2026-07-06T18:46:39.497352Z","submitted_at":"2024-06-26T07:34:53Z","title":"Navigating the Minefield of MT Beam Search in Cascaded Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":"2407.11010","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.11010","snapshot_observed_at":"2026-08-07T11:34:35.698458Z","title":"Navigating the Minefield of MT Beam Search in Cascaded Streaming Speech Translation","venue":"cs.CL","work_id":"28dd3fa8-9972-4e38-8382-f040e40bd4bb","year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.484883Z"},"links":{"cited_paper":"/paper/2407.11010","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:5a4dd383972e7af4ee0caf64a880b1b0d9e2a6575f47c4de46714f6e5f61dbbe","observation_id":"b071520b-e8d6-4c1c-9eb5-c82ca01fe2e4","resolution":{"observed_at":"2026-08-07T11:34:35.812184Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:37.911946Z","title":null,"venue":null,"work_id":"bf3c64f5-994b-4330-9aa6-aad3c85baf95","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.632605Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:7dedd40e2a9f4ce436b8930c7e2b4b5b4dc1dcd6f03446360c5604f5aa8a6c43","observation_id":"c9dddfd9-d458-4ff7-8ba5-ff381ccc6fd7","resolution":{"observed_at":"2026-08-07T11:34:38.011160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2014-511","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:33.742725Z","title":null,"venue":null,"work_id":"b7de8ab7-3c1c-4213-998c-b267204adea8","year":2014},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.833844Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:136a4b6ab53b260e3d5b50e63644de3054e83d0bbb4d99d13c34f7805e7e6112","observation_id":"51f4b4dc-5d57-4990-8957-822ff21b4f2e","resolution":{"observed_at":"2026-08-07T11:34:33.858378Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:37.632773Z","title":null,"venue":null,"work_id":"01abbfa2-b347-42fd-876c-1131b262397a","year":2017},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.969042Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:8e9c4bcf4e56bd23b283ede9f7c0087770c612f85dc16250cc16a9ffb8d69c7f","observation_id":"5cb3ec41-9bf8-45b5-92c2-c8f2860dbdae","resolution":{"observed_at":"2026-08-07T11:34:37.771136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:37.366394Z","title":null,"venue":null,"work_id":"995f5606-6f4c-4fd7-a898-ae7bbcdb21d9","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.093923Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:d48a9f17e651091c0b6d08bbf471578ae926c74912dd208cd817a6a41f3559f6","observation_id":"42a13465-cbde-4594-8f61-2ca04635421b","resolution":{"observed_at":"2026-08-07T11:34:37.496442Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2023-2004","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:33.496320Z","title":null,"venue":null,"work_id":"f7bde6b0-e9c5-4b30-b425-da7b807ad696","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.240081Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:a388b001317e8e788c7d937d84de8e66a7759f8f8a0740fb031c9f81437750ae","observation_id":"f8e16c53-a784-45ce-8227-d9480488767b","resolution":{"observed_at":"2026-08-07T11:34:33.618516Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11619","last_updated":"2024-03-25T21:08:06Z","snapshot_observed_at":"2026-07-06T18:01:45.549839Z","submitted_at":"2024-03-25T21:08:06Z","title":"Advancing Speech Translation: A Corpus of Mandarin-English Conversational Telephone Speech","version":1},"cited_work":{"arxiv_id":"2404.11619","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.11619","snapshot_observed_at":"2026-08-07T11:34:35.400288Z","title":"Advancing Speech Translation: A Corpus of Mandarin-English Conversational Telephone Speech","venue":"eess.AS","work_id":"d9cf53c9-4f79-4e4a-9fd0-13a249804bdb","year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.393483Z"},"links":{"cited_paper":"/paper/2404.11619","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:4a77bffc1b1f8134ff3e170173af978b19a8e0862a237318f6cf0748b271274d","observation_id":"7ae20168-a86d-412d-824c-fca98f94dc2a","resolution":{"observed_at":"2026-08-07T11:34:35.526845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:37.157423Z","title":null,"venue":null,"work_id":"aac656f3-a7c3-4ae9-8dab-eabe7c733c68","year":2022},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.508617Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:770f31503c0837dfa072b6bfbcd73b56c6155b965a76d1b3d3d33029a66d8c62","observation_id":"d6e28113-bda8-406c-94a8-b6365e613a2c","resolution":{"observed_at":"2026-08-07T11:34:37.247803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:36.959876Z","title":null,"venue":null,"work_id":"48a3e8d1-a4bf-4921-b95e-66a3975cb0f7","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.670166Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:c4072a13bf932b325d8df346ac48bce4fd443162431d35501811b384369ec453","observation_id":"e8600bb3-4008-4de6-858f-86a38cfcb3a9","resolution":{"observed_at":"2026-08-07T11:34:37.061244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-demo.38","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:33.284129Z","title":null,"venue":null,"work_id":"39b00769-548a-45d2-878f-a6b491d9d92f","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.817243Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:3890722b10438dd11c139fefbd2b48b47543dcb36d3577482ade0c65b218811c","observation_id":"9f29a2e1-97a6-4fbb-855e-b4694b2f376e","resolution":{"observed_at":"2026-08-07T11:34:33.376651Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04596","last_updated":"2023-07-06T20:07:49Z","snapshot_observed_at":"2026-08-06T06:09:10.828875Z","submitted_at":"2023-04-10T14:05:22Z","title":"ESPnet-ST-v2: Multipurpose Spoken Language Translation Toolkit","version":3},"cited_work":{"arxiv_id":"2304.04596","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.04596","snapshot_observed_at":"2026-08-07T11:34:35.157973Z","title":"ESPnet-ST-v2: Multipurpose Spoken Language Translation Toolkit","venue":"cs.SD","work_id":"826a06d3-70ae-4254-8aa7-faeefd60222c","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.944822Z"},"links":{"cited_paper":"/paper/2304.04596","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:b4dadaa09a54413693c9fbde852b9e61f97e61a89936da5649a3d3e61acc3d70","observation_id":"6392f00a-4175-4254-9216-1d3ee4ed74c3","resolution":{"observed_at":"2026-08-07T11:34:35.250905Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.iwslt-1.29","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:32.993246Z","title":null,"venue":null,"work_id":"e6793d1d-0172-4cd5-94f9-9303d69943db","year":2022},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.084757Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:929133459870d6c744050ac8c387b5a98c2ae5fec476510f063c8ebc9fa752cb","observation_id":"cf0ea1a3-69d9-44e3-b8d8-80cd0d7841c2","resolution":{"observed_at":"2026-08-07T11:34:33.140467Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:36.707161Z","title":null,"venue":null,"work_id":"7db1c196-4110-4e75-8a80-1c42c2af8035","year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.206610Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:668bbf2744d91ca1cfd659e3ac0415f443ea1ddd76e51a002f615e79c5659d21","observation_id":"a31554b0-45d7-4eaf-b676-9ac15e427ac7","resolution":{"observed_at":"2026-08-07T11:34:36.817294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05101","last_updated":"2025-02-14T13:13:03Z","snapshot_observed_at":"2026-07-06T19:29:05.492290Z","submitted_at":"2024-10-07T14:56:07Z","title":"CR-CTC: Consistency regularization on CTC for improved speech recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05101","snapshot_observed_at":"2026-08-07T11:34:32.344603Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.344603Z"},"links":{"cited_paper":"/paper/2410.05101","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:baab9c363e3d48571ddc106cf3ff3863d6608eb1a62750271844d6afdc6457b1","observation_id":"bef1cf9d-1cc1-4a50-981d-152c977a0b9e","resolution":{"observed_at":"2026-08-07T11:34:32.344603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:36.444570Z","title":null,"venue":null,"work_id":"65bcdf1f-f80c-4d45-8297-44eb07572d63","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.493596Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:ca7a7d2c58fcef66b2707293fd159c8bfc9ccba132b4d434bd63c541e08c5b54","observation_id":"ea4b0487-9d67-4b15-8f29-be062b72e239","resolution":{"observed_at":"2026-08-07T11:34:36.553387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:32.661208Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.661208Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:6256ff54c0818d5cbc507624cb463186d3b2ab7ce9dd38615f0766d905c9d599","observation_id":"b53791f0-12ab-4868-9ec4-4ea56758532e","resolution":{"observed_at":"2026-08-07T11:34:32.661208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:32.822198Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.822198Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:aec94f1068692b8c2be1ab073d3d7b8bf73f8d1bc08d506278e769843aaf79a4","observation_id":"26f93247-ff72-4e76-8f7b-abb2f600120c","resolution":{"observed_at":"2026-08-07T11:34:32.822198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T11:27:13.298583Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":30,"verified_exact":11,"verified_fuzzy":2},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2506.02157."}