{"as_of":"2026-08-16T03:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a0c98436a38fb5145cc7b79944b5a2a22c4601eb0de9971553421343330fbc67","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T21:39:19.777785Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.04266/citation-record","integrity":"/paper/2412.04266/integrity","json":"/paper/2412.04266/citation-record.json","paper":"/paper/2412.04266"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.725035Z","title":null,"venue":null,"work_id":"f4302fbd-9954-4cfe-ae69-1471fc4f648c","year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.372443Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:2d8a5c8be58ed0ce4056cae3cd09860680ea4547d5f10f62cd850380a0ea025e","observation_id":"90cd4b0a-9d59-4609-aa2b-ca4062338c95","resolution":{"observed_at":"2026-08-11T21:39:21.730740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.378950Z","title":"Ardila, M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.378950Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:fb341efbba6aa41b99ad5889278ebd25edd80ab651a6edc189415dc04faa5e05","observation_id":"6379f961-fe9e-448b-8d57-3be45ce07671","resolution":{"observed_at":"2026-08-11T21:39:19.378950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.385255Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.385255Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:1f175e6580e8a8e496f8a2accf06ef03f1fb0fe4a53ddabb315f105a8f067ad6","observation_id":"6a18ed45-6f89-4525-8d43-26ee214101dd","resolution":{"observed_at":"2026-08-11T21:39:19.385255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09872","last_updated":"2022-09-15T17:02:17Z","snapshot_observed_at":"2026-08-13T15:40:24.639521Z","submitted_at":"2022-05-19T21:34:40Z","title":"Content-Context Factorized Representations for Automated Speech Recognition","version":2},"cited_work":{"arxiv_id":"2205.09872","doi":null,"metadata_source":"pith","pith_arxiv_id":"2205.09872","snapshot_observed_at":"2026-08-11T21:39:21.051172Z","title":"Content-Context Factorized Representations for Automated Speech Recognition","venue":"eess.AS","work_id":"2a35b3a3-1284-4bc9-a438-a3749018a810","year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.391301Z"},"links":{"cited_paper":"/paper/2205.09872","citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:7da6158ae250e5754f129b8e4776738fe5caff75845996b07472fa93d697b48c","observation_id":"56a5301c-581a-4d7f-8806-453bf4904f6f","resolution":{"observed_at":"2026-08-11T21:39:21.060685Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.669349Z","title":null,"venue":null,"work_id":"e3b6841b-525a-4335-85a0-cb4105bd093c","year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.397194Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:2fca2298074f1d09e59a49c5d9b0e86d299b9dff360a6f5948295604dafaebd6","observation_id":"b6500789-2451-4ca2-92a9-b7f6db710051","resolution":{"observed_at":"2026-08-11T21:39:21.678143Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.403146Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.403146Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:1708003b254e743ebae736db348a323cf6dbc6d98abd2b70457e2d246e2b8a25","observation_id":"8b9dc300-1c71-485e-98ff-9cc561cf2ca7","resolution":{"observed_at":"2026-08-11T21:39:19.403146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05742","last_updated":"2019-08-22T17:18:16Z","snapshot_observed_at":"2026-08-14T16:48:34.482292Z","submitted_at":"2019-04-10T16:22:18Z","title":"One-shot Voice Conversion by Separating Speaker and Content Representations with Instance Normalization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05742","snapshot_observed_at":"2026-08-11T21:39:19.410011Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.410011Z"},"links":{"cited_paper":"/paper/1904.05742","citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:cf664f3c102209627b69b7aa7e316dd95e1dcf3d23ae2eaae495bc5d1300864c","observation_id":"5a0817c1-7f39-4af1-9b74-be494c97baf6","resolution":{"observed_at":"2026-08-11T21:39:19.410011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.415538Z","title":"Di Gangi, Roldano Cattoni, Luisa Bentivogli, Matteo Negri, and Marco Turchi","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.415538Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:001815c2a5356b379c60ffb70a704193cc1093854cddacb97937580ace39cffc","observation_id":"68f11807-ffef-4a44-84a2-1f0f67190950","resolution":{"observed_at":"2026-08-11T21:39:19.415538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.635486Z","title":null,"venue":null,"work_id":"2b99f0cb-90b2-4dd1-b3a7-63446e798a2d","year":2021},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.421456Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:8ed46814311eb3efa51f8d13844118b1022edf63caeae68aa3dc98f0ddadf93d","observation_id":"a0b40a33-7351-40b5-9572-0961555ba5a9","resolution":{"observed_at":"2026-08-11T21:39:21.640965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.614955Z","title":null,"venue":null,"work_id":"2e9044fe-4941-4a35-965e-fbbaabf29239","year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.426635Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:fd570ebdf61d15438763b35fb818498cd345e8f229b92e879cd3b7f4f76c4df1","observation_id":"4e42dfa5-6a70-4bcd-a643-961ba05e9f3a","resolution":{"observed_at":"2026-08-11T21:39:21.621890Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-long.251","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:20.187523Z","title":null,"venue":null,"work_id":"622b54ed-42f1-4417-8fa1-ec3c5673688c","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.435703Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:03946cb214e0b468d3da577ed8a72763f78cabaf8fa83f43090f6377528ea999","observation_id":"dc0a2f88-c3f8-48f6-892d-c24bc7d6737b","resolution":{"observed_at":"2026-08-11T21:39:20.193438Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.442508Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.442508Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:9e6f4fa1a92da8826aba5a0d7d6b80410bae3998efb1f9e7ce3fb1eb33a491c1","observation_id":"71634c60-0367-4b66-947a-2bc7537cc075","resolution":{"observed_at":"2026-08-11T21:39:19.442508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.448074Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.448074Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:edfa521b773ae29cb9b18ca80594d4907b493c52cfe1c1e09a97c33571ebc975","observation_id":"2deaa760-f643-473a-b12e-aa83a47bb1ea","resolution":{"observed_at":"2026-08-11T21:39:19.448074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.456088Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.456088Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:ea6fddbe73fdc709ce2c16b0bff0d7d3441c47b15dc98f233f7a82af89cd525d","observation_id":"d88d32f1-8f81-4f5e-a35c-9840ef026d0a","resolution":{"observed_at":"2026-08-11T21:39:19.456088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.462027Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.462027Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:32abf32caabbc45eac7e08f1bae7a581cbf3a6c444479dda97e1fd39ddebc49a","observation_id":"8d6d8f86-0833-4034-a1f6-33bded93c4d1","resolution":{"observed_at":"2026-08-11T21:39:19.462027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.560","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:20.167868Z","title":null,"venue":null,"work_id":"d77a400c-8e44-4084-a1ed-831e1cad56b9","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.468323Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:5be7d3ec7bd3204730d3a43e1dca921377c5030bc339bca2985e5cc3adeb792f","observation_id":"e47f245d-c010-4212-afd9-265c16caa95b","resolution":{"observed_at":"2026-08-11T21:39:20.173239Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.552401Z","title":null,"venue":null,"work_id":"cc1a7e24-bdd4-4ff6-8e96-b0cf63324991","year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.474580Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:7efa80d87c2ccbbf17f7075b53415f1af07b7efa9fe9ad63da5efd18eeca1c8c","observation_id":"09dd9313-16a8-4be6-b322-c70ffa917a9c","resolution":{"observed_at":"2026-08-11T21:39:21.557791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-14T18:51:16.666127Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-11T21:39:19.482221Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.482221Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:60c14821b71755bade1f541f44f96930969a6d3c45909a6ce56ed642e8f7b5be","observation_id":"1be65cc3-fa55-413e-a625-c4676dee0808","resolution":{"observed_at":"2026-08-11T21:39:19.482221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/s23167282","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.981648Z","title":null,"venue":null,"work_id":"a0d14655-d9f8-4f46-9d76-474f186a45c3","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.488653Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:cf888783e39df07b67fb931b2910ab92a4a8f2332a5059500e1b3628627b4ef4","observation_id":"4586f8c0-873e-4b06-a047-93e7a554e128","resolution":{"observed_at":"2026-08-11T21:39:20.151945Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.494953Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.494953Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:b8bd85f42e538553064b0dab2bc438c9422a750a536336d5b705633292219c13","observation_id":"fd881abe-c574-45d7-90dd-b2ae80983648","resolution":{"observed_at":"2026-08-11T21:39:19.494953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.534154Z","title":null,"venue":null,"work_id":"57452971-cc9c-4e05-8c11-3bfb0ba19a0d","year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.500782Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:6c707798eaa9b1cce9e9720ef8937c83823ad903232ed94408d36dcc85010ea9","observation_id":"6d894e5f-535e-4731-a59c-5ce713cab8d2","resolution":{"observed_at":"2026-08-11T21:39:21.539840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.515450Z","title":null,"venue":null,"work_id":"d5203fde-b279-4b40-b803-e1299637c69c","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.507708Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:27d1ce5774ee1f1200347788f1b82c04ce6e6c2c6950906d5a9eb407fa7a5276","observation_id":"dfba5876-797a-4927-b2c0-8be19b733b52","resolution":{"observed_at":"2026-08-11T21:39:21.520928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.09474","last_updated":"2021-06-25T01:55:08Z","snapshot_observed_at":"2026-08-13T19:57:06.866122Z","submitted_at":"2021-03-17T07:11:09Z","title":"STYLER: Style Factor Modeling with Rapidity and Robustness via Speech Decomposition for Expressive and Controllable Neural Text to Speech","version":4},"cited_work":{"arxiv_id":"2103.09474","doi":null,"metadata_source":"pith","pith_arxiv_id":"2103.09474","snapshot_observed_at":"2026-08-11T21:39:20.906725Z","title":"STYLER: Style Factor Modeling with Rapidity and Robustness via Speech Decomposition for Expressive and Controllable Neural Text to Speech","venue":"eess.AS","work_id":"d2e07f21-3d63-4ffa-b54a-0d75383ea9e6","year":2021},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.513157Z"},"links":{"cited_paper":"/paper/2103.09474","citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:b988b99738ac8abc75abfb650393a3815ee306266098a186621576d40b52fd38","observation_id":"f3e69ecb-2649-4fb0-94c1-295f3eee3f67","resolution":{"observed_at":"2026-08-11T21:39:20.913950Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-acl.195","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.951360Z","title":null,"venue":null,"work_id":"8ec87a67-6b8f-4f94-896f-020f7c020bc0","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.519378Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:fa89e4e639d6a38971644d6afb76bbdf82d8d2a1977c15b82b78fcc936e9575e","observation_id":"b2279c4c-0331-45f9-8c24-60d55036ccd1","resolution":{"observed_at":"2026-08-11T21:39:19.956624Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.10305","last_updated":"2023-03-04T09:52:08Z","snapshot_observed_at":"2026-08-13T14:02:18.189719Z","submitted_at":"2022-10-19T05:33:27Z","title":"A Unified Neural Network Model for Readability Assessment with Feature Projection and Length-Balanced Loss","version":2},"cited_work":{"arxiv_id":"2210.10305","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.10305","snapshot_observed_at":"2026-08-11T21:39:20.877038Z","title":"A Unified Neural Network Model for Readability Assessment with Feature Projection and Length-Balanced Loss","venue":"cs.CL","work_id":"a0be8ea2-33e6-487d-afc1-da35891d3513","year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.525945Z"},"links":{"cited_paper":"/paper/2210.10305","citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:f66be4aca1ac83baca426eff30541302bdef28636572170399d019ede529cc1d","observation_id":"d045bb3b-c362-45e0-92bb-727380ebca09","resolution":{"observed_at":"2026-08-11T21:39:20.884393Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.498369Z","title":null,"venue":null,"work_id":"a68d40a6-970e-4355-9573-02b390e3bd11","year":2019},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.531965Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:f0d7f51d1891576c567814d4a10f2b763f471c67f8377ff953e8c09853b8b7d4","observation_id":"c7468989-0591-4b91-9c64-7470dee9a022","resolution":{"observed_at":"2026-08-11T21:39:21.503732Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.14920","last_updated":"2020-10-28T12:33:04Z","snapshot_observed_at":"2026-08-14T02:30:27.760419Z","submitted_at":"2020-10-28T12:33:04Z","title":"Bridging the Modality Gap for Speech-to-Text Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.14920","snapshot_observed_at":"2026-08-11T21:39:19.538174Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.538174Z"},"links":{"cited_paper":"/paper/2010.14920","citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:9769f8a193250b561330949d22367a1db51ed8dc2b2733a6d78921c407d36415","observation_id":"3b4cf49f-a39b-480a-a53f-1d89c37c06d5","resolution":{"observed_at":"2026-08-11T21:39:19.538174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.478647Z","title":null,"venue":null,"work_id":"409aaa32-43da-44c1-b682-48c28e1bd37a","year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.543901Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:c55ac18c54195192a15598395b9d8ebb62cf22ded47e57693973221827171c9b","observation_id":"b57d4888-c7d2-4f87-b4c1-19dca566b6c8","resolution":{"observed_at":"2026-08-11T21:39:21.485227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.548944Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.548944Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:0a30f26015830a89ae479a2dac9137c4bd23325b16fb3c92e03022a3994d6443","observation_id":"d45b2a2b-7d9d-4c4f-b5c8-899f0a74ee0c","resolution":{"observed_at":"2026-08-11T21:39:19.548944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.554237Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.554237Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:746a0876716ba09d2286af433e61a207223e0e826d429eaade25d8c9286f5399","observation_id":"983b953f-3b49-4529-9bca-2bf866bb0865","resolution":{"observed_at":"2026-08-11T21:39:19.554237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.559467Z","title":"Park, William Chan, Yu Zhang, Chung-Cheng Chiu, Barret Zoph, Ekin D","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.559467Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:49ace558fd68ca197955ff6162e3f72d0c04525aebdd97d22c5d6d68e203e4a6","observation_id":"28451c3c-c428-44b2-8aff-8e248a892096","resolution":{"observed_at":"2026-08-11T21:39:19.559467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.445935Z","title":null,"venue":null,"work_id":"05cac992-b611-482d-b4e5-34f0ae6f58b9","year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.564488Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:1838539cc74da429c00af4b8ffb2a16f63806f47f9b2d2872bf4e86fbe8d3489","observation_id":"2517199a-a9b1-4e03-b035-e1bfb3e7593b","resolution":{"observed_at":"2026-08-11T21:39:21.452898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.569615Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.569615Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:96f0376d2b96eed3226518b18bbdc194b0785911c54a504cdaec590153733977","observation_id":"b2204d89-88fc-4498-85c5-8d79abfe19a6","resolution":{"observed_at":"2026-08-11T21:39:19.569615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.575666Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.575666Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:eea5510cb8b84eec65ee0c1903ad86b012db1db9d8df39fc354924fb5c02ff09","observation_id":"75abf62f-55e3-4a95-8f54-82cdc11794e0","resolution":{"observed_at":"2026-08-11T21:39:19.575666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.416510Z","title":null,"venue":null,"work_id":"de062b64-a6cf-4267-a71b-c114200830dd","year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.581667Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:05c1b422bc93810b8f8f98c7391f8b8fbf1f353ca71bfd95fdf7509322792dca","observation_id":"798157be-6196-4a3c-98fd-fac4ada78bad","resolution":{"observed_at":"2026-08-11T21:39:21.421700Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.acl-main.726","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.910646Z","title":null,"venue":null,"work_id":"d43e3642-68ee-44cc-bf9e-028182828649","year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.587355Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:f02f6536dfde7eaa2c03397b1782f2b0cf2f0e67f567a14641f98d670dc33728","observation_id":"db671967-408c-425d-a0ae-0d34d33d48b9","resolution":{"observed_at":"2026-08-11T21:39:19.916311Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.593527Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.593527Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:68ad71f4b0e0995524e07a082cc9d3a1e50f35b622053fd12f8e706d8706a7ef","observation_id":"da2f4485-99a1-4330-9621-4e00d7880ec3","resolution":{"observed_at":"2026-08-11T21:39:19.593527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.386760Z","title":null,"venue":null,"work_id":"795b8b25-c6c3-4e5f-a183-46f394406c1a","year":2018},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.599794Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:1e808661bcbc488b1666448b592d2abf06e691d6836bca54c141779e318fe5a2","observation_id":"20c63ccb-bc9f-4498-99a7-89a0a6729b4e","resolution":{"observed_at":"2026-08-11T21:39:21.392694Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.365154Z","title":null,"venue":null,"work_id":"ebd5da6f-2a58-4ff6-ab00-31f261a25c0a","year":2017},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.606871Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:f2334bbf74afaff8d19a8781c6b56452167d832a15357e5164ef70708a1c5e3f","observation_id":"73be8f1f-babc-4fa5-951e-2ef566f3b9d6","resolution":{"observed_at":"2026-08-11T21:39:21.372782Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/p19-1115","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.890888Z","title":null,"venue":null,"work_id":"b2606a22-0ce5-4ae6-89af-2a5264b03a6d","year":2019},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.612636Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:f5fb2fe6fee286902f67db7a201523b00683bde395f78e0c3d09a169ca78dbd2","observation_id":"bc6f2780-b6a7-4712-865d-90f01dbb3f39","resolution":{"observed_at":"2026-08-11T21:39:19.897060Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.619383Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.619383Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:3ecef85dabc3a41c1df4e0b70ea0cfb78f3988bcbb57f911733b5dd1c8690aa6","observation_id":"04bd887b-4196-4946-af6f-4184df515ac2","resolution":{"observed_at":"2026-08-11T21:39:19.619383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.625040Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.625040Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:120dedfc1e194f8989de56bf0afe5056f3b61f66a61fe67dfd924ee37eba20b8","observation_id":"0630fbbe-8579-4732-9d48-bd3ce46f74ca","resolution":{"observed_at":"2026-08-11T21:39:19.625040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.315998Z","title":null,"venue":null,"work_id":"1f3821e0-4a04-48c8-85e0-ec3787f13304","year":2021},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.630230Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:3c493c44ee9412f83c1b27c48f4101643991d98825400e5fd1a5449400039021","observation_id":"1f16f692-649a-471b-bdec-7af05ef4730a","resolution":{"observed_at":"2026-08-11T21:39:21.322104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.293962Z","title":null,"venue":null,"work_id":"b02db01a-2c17-4350-a1ad-348badf81b1e","year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.635477Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:e3073fca412a0fae451f1c30ca3bbcba2df36e6dccfc99819f66a71a9fadebfc","observation_id":"8dfe3bf3-aba3-4570-a1c7-26a786298d6b","resolution":{"observed_at":"2026-08-11T21:39:21.301121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.10310","last_updated":"2020-10-24T06:07:01Z","snapshot_observed_at":"2026-08-14T22:10:56.475667Z","submitted_at":"2020-07-20T17:53:35Z","title":"CoVoST 2 and Massively Multilingual Speech-to-Text Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.10310","snapshot_observed_at":"2026-08-11T21:39:19.640925Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.640925Z"},"links":{"cited_paper":"/paper/2007.10310","citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:4ab524dd3191330b7478b153b3979e46e676eb2750b2620116c31082e8d537ee","observation_id":"ac0c87d8-2eba-4bef-9496-8395d8cd9da5","resolution":{"observed_at":"2026-08-11T21:39:19.640925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v34i05.6452","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.871246Z","title":null,"venue":null,"work_id":"2d32b569-b9ca-4fe1-8628-989e59c9757c","year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.647769Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:89d2cf67c31e035ae0644153608130ccb828d1b34bf77cef9c0f9041adfd2dc0","observation_id":"3298dbe2-2333-4ad0-b22b-e43e8cc3af03","resolution":{"observed_at":"2026-08-11T21:39:19.877722Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.276031Z","title":null,"venue":null,"work_id":"a19bc434-f573-41f7-92af-1e6dfab53f41","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.653372Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:f69bd3551640c0ade12d15ae314cb60d73dc4fb433aca7b9cd14195f27e73e75","observation_id":"0a4c7f8d-0acd-444f-b1de-a1e02f248d2d","resolution":{"observed_at":"2026-08-11T21:39:21.281386Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.31429","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:20.721071Z","title":null,"venue":null,"work_id":"8cb0db42-93aa-4fd2-9744-f4cb2cb55e9c","year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.659304Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:bb7216f2222a149595ca1a14fb8d1371abf2dffe5ae99e27bbc4474122134d23","observation_id":"1e341428-8387-4f38-9db0-c35781d3eb0e","resolution":{"observed_at":"2026-08-11T21:39:20.731156Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.256949Z","title":null,"venue":null,"work_id":"4dbe29c2-f0ca-415c-88bb-bf2e8ac42c6d","year":2020},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.666876Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:2a993c3c48dbcc286c80526f864d5b6cb1d3014a142af606464103f74b7f989a","observation_id":"bb578b46-b08c-4187-86d9-1250b85fd39a","resolution":{"observed_at":"2026-08-11T21:39:21.263017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.237404Z","title":null,"venue":null,"work_id":"e893549c-ead9-42f0-8050-d0fb01ebce7c","year":2021},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.673241Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:2bc91aec5f656dd529c8f713f329b728ea9e876e5f605ef426aaa8e66078b297","observation_id":"bca6b264-be60-4f70-8344-df6e9cce631d","resolution":{"observed_at":"2026-08-11T21:39:21.243651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2022-571","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.850545Z","title":null,"venue":null,"work_id":"7d4853ac-2115-43fb-b614-a6a181ef1ea5","year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.685462Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:a7d92ffe4b9bb9a4a4ee2050d6732ad17357c1db30ad5724d02d6f0e323c04ed","observation_id":"4efb59ef-3850-4f6e-beba-af547ee09018","resolution":{"observed_at":"2026-08-11T21:39:19.857209Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.15018","last_updated":"2022-02-16T17:48:42Z","snapshot_observed_at":"2026-08-12T22:56:40.309048Z","submitted_at":"2021-10-28T10:58:22Z","title":"TorchAudio: Building Blocks for Audio and Speech Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.15018","snapshot_observed_at":"2026-08-11T21:39:19.690703Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.690703Z"},"links":{"cited_paper":"/paper/2110.15018","citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:d8aa0a530f04fcf9fad573d2a8a98c2ac2c158354f4224457ef4243229b5cd81","observation_id":"f0bf752d-d94e-4e1d-bbd9-ff3e317340fb","resolution":{"observed_at":"2026-08-11T21:39:19.690703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.698283Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.698283Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:3dae93e4256c38112c92af4a55bf0db929b0df3ea6f6c31d6b33388d173e9c1e","observation_id":"34202884-926b-46c7-a8c0-c7281aac475d","resolution":{"observed_at":"2026-08-11T21:39:19.698283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10380","last_updated":"2021-06-18T04:01:23Z","snapshot_observed_at":"2026-08-13T19:35:51.057593Z","submitted_at":"2021-04-21T06:44:31Z","title":"End-to-end Speech Translation via Cross-modal Progressive Training","version":2},"cited_work":{"arxiv_id":"2104.10380","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.10380","snapshot_observed_at":"2026-08-11T21:39:20.447737Z","title":"End-to-end Speech Translation via Cross-modal Progressive Training","venue":"cs.CL","work_id":"14900412-b46b-441b-b558-86f7f8919c7c","year":2021},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.703737Z"},"links":{"cited_paper":"/paper/2104.10380","citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:b76a88a02950237c3a5a8b7be47f573694bd84b9171a99cc83aefe337c2fcc97","observation_id":"8e2120d5-33ec-48c2-b5ce-7eb0644d1d8d","resolution":{"observed_at":"2026-08-11T21:39:20.454427Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.709356Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.709356Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:2b1ce37289700b929fc9aadb38b772d34d49e916e20d97bb9e6acce0961bb3f6","observation_id":"f8e345d6-9beb-4611-9a87-ebfe3a7dc78a","resolution":{"observed_at":"2026-08-11T21:39:19.709356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.203932Z","title":null,"venue":null,"work_id":"9ef58d43-cefe-4122-a47a-a1baa3f07c40","year":2024},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.715759Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:459225193d767066bd5c6f32536c505896a6b5b204729bd49513542e69ac4c03","observation_id":"9fa30252-d9f5-4004-8131-597bf316b845","resolution":{"observed_at":"2026-08-11T21:39:21.211160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.181132Z","title":null,"venue":null,"work_id":"5b9523d9-7d2e-4e41-8cd0-7a67d066078d","year":2022},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.721048Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:001f2dcccacca3fc3cbf67b4736b63d81409790dbec136cfe39b65415663db07","observation_id":"6171d850-2762-4dc6-95c3-b70630dd640e","resolution":{"observed_at":"2026-08-11T21:39:21.186841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.160568Z","title":null,"venue":null,"work_id":"cde38607-a321-4b12-b053-3c975ab0b6cb","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.726706Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:9ef7ff3e192d87aa7fedfe2e90d66aea88acf0b6c4e1446e24ade23985c52fcb","observation_id":"b8fd8717-6e4f-402b-bfcd-f46183bd86da","resolution":{"observed_at":"2026-08-11T21:39:21.166222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.732892Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.732892Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:6bc5d0cf8003e10b10559d4f87ea60879a216d30a996745ef3b70065ecbd6e11","observation_id":"799dbc75-04d9-480f-893a-37669620ce75","resolution":{"observed_at":"2026-08-11T21:39:19.732892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.738501Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.738501Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:f355ecddfbc02cf94bc041bcd44c3ec9d56e46c50f242d66cb0411e8f6c25a37","observation_id":"3f81ee92-9b72-40fb-a0c7-ea707276eae0","resolution":{"observed_at":"2026-08-11T21:39:19.738501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.142168Z","title":null,"venue":null,"work_id":"d767dfd2-e3bb-4ced-b35d-a2a7c95fec4e","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.743642Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:f9c396de48541f133277d9c969dee23d882648bc5ec99ea90ff41b70797ec148","observation_id":"c1768b27-14f1-4280-b463-5c4a8be6435b","resolution":{"observed_at":"2026-08-11T21:39:21.147248Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.394","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.817056Z","title":null,"venue":null,"work_id":"3b080811-5724-49da-8552-022444fca89e","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.748907Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:23017472c3674196ff179272a64910edbca1e1490d3b864c64f8cc3cf4436a86","observation_id":"12761f92-bd44-435d-8fb1-11715b2b13ba","resolution":{"observed_at":"2026-08-11T21:39:19.823456Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.124747Z","title":null,"venue":null,"work_id":"6dd073be-a1d8-4e93-98b6-6f7a8107c987","year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.753933Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:50968d8d45574f975e817e4815dad46cb47d90ba94f5aba104368a38caa36232","observation_id":"ce1f85c2-33ec-4095-8205-52ccd795763d","resolution":{"observed_at":"2026-08-11T21:39:21.130075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:21.105393Z","title":null,"venue":null,"work_id":"c344208a-66c0-4c43-8cde-4cb786a451a3","year":2024},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.760174Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:d0202acb8dde97d358f9efe76a756d1905996d6d6cd769c4ba8240097e623420","observation_id":"4831bc68-4bcf-4005-b907-e88914f4bb71","resolution":{"observed_at":"2026-08-11T21:39:21.111684Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.765982Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.765982Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:affee3b3b705cddd84fa0409596b46d7cfb09a1cd864c39e9cbd79346499c764","observation_id":"03d29560-8572-4bf6-8f88-035d7853a353","resolution":{"observed_at":"2026-08-11T21:39:19.765982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.771676Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.771676Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:6e6e125323b63ea27e2bbeb96b3561a6eff968817bbb529f3c3d3cdde727b212","observation_id":"45df2fc3-3b21-4e3e-9346-2473fff0b249","resolution":{"observed_at":"2026-08-11T21:39:19.771676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T21:39:19.777785Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-11T21:39:19.777785Z"},"links":{"citing_paper":"/paper/2412.04266"},"observation_digest":"sha256:0e26285457806f8201b71e95d84bb80c5e00de2839d65795c0d6bc087fd9cc50","observation_id":"a3cdcea9-c58f-4362-ac5f-3b35ebdecf4e","resolution":{"observed_at":"2026-08-11T21:39:19.777785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.04266","last_updated":"2024-12-05T15:50:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T05:12:44.229559Z","submitted_at":"2024-12-05T15:50:44Z","title":"Representation Purification for End-to-End Speech Translation"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":53,"verified_exact":12,"verified_fuzzy":0},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2412.04266."}