{"as_of":"2026-08-08T08:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2f61b93705e9139944f0e1627f71716d63705c50731f9fb9ea502f98bb3472ca","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:56:36.190978Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:56:36.075380Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T10:56:36.226669Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"cited_work":{"arxiv_id":"2506.03831","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03831","snapshot_observed_at":"2026-08-07T10:56:36.226669Z","title":"Conformer-based Ultrasound-to-Speech Conversion","venue":"cs.SD","work_id":"17aaa84c-313d-442f-8ce0-723f9851165c","year":2025},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.075380Z"},"links":{"cited_paper":"/paper/2506.03831","citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:22f9ef0e9f2d40a4526ac42db1c0a5aef4305ac735a3568a68b6d410703d621b","observation_id":"a7ededf3-9612-4661-9552-b200a647d1a1","resolution":{"observed_at":"2026-08-07T10:56:36.233992Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03831/citation-record","integrity":"/paper/2506.03831/integrity","json":"/paper/2506.03831/citation-record.json","paper":"/paper/2506.03831"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"cited_work":{"arxiv_id":"2506.03831","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.03831","snapshot_observed_at":"2026-08-07T10:56:36.226669Z","title":"Conformer-based Ultrasound-to-Speech Conversion","venue":"cs.SD","work_id":"17aaa84c-313d-442f-8ce0-723f9851165c","year":2025},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.075380Z"},"links":{"cited_paper":"/paper/2506.03831","citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:22f9ef0e9f2d40a4526ac42db1c0a5aef4305ac735a3568a68b6d410703d621b","observation_id":"a7ededf3-9612-4661-9552-b200a647d1a1","resolution":{"observed_at":"2026-08-07T10:56:36.233992Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.587226Z","title":"This dataset includes recording of the tongue movements using an ultrasound system called ”Micro” by Articulate Instruments Ltd","venue":null,"work_id":"ef98a23f-f549-41fd-8fed-7fba97c3ab49","year":null},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.080486Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:d613b5e688eb12506387c8fed6045638b2431cc98e17e302a5938cbd7ae398b7","observation_id":"6bd4ef5f-e746-4fb3-b795-46c19303be9f","resolution":{"observed_at":"2026-08-07T10:56:36.590838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.577186Z","title":null,"venue":null,"work_id":"dc4d5aa1-c982-4738-a111-d75ac5a87aea","year":null},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.085259Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:592ac4cb84255cc55ec061c0daad39cb09b68e48f29739e6895b5b4eeabb16f0","observation_id":"e0700c51-bc2c-45cc-81fd-d3aad3314e7b","resolution":{"observed_at":"2026-08-07T10:56:36.580950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.565867Z","title":null,"venue":null,"work_id":"fc7027a1-576b-40db-b08a-ef29d6f57b16","year":null},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.089486Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:fb49a294706694868281ab922f9d78e0d716ef771822b5d438a42ee5ef694fcf","observation_id":"858c625a-7a4e-4d0e-8069-476198d539c0","resolution":{"observed_at":"2026-08-07T10:56:36.569631Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.15544868","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.554326Z","title":null,"venue":null,"work_id":"5488c821-f710-4795-8a2d-92182831cb3b","year":null},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.093793Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:46884a66bb0c11b7f638da3e19d080202f82d3918b6c89318344d10bd641cc76","observation_id":"5179e529-c5af-44b7-853f-70fcd45b9f67","resolution":{"observed_at":"2026-08-07T10:56:36.558192Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.542295Z","title":"This work is dedicated to the memory of Dr","venue":null,"work_id":"2f0e17f6-f8cf-4308-a02b-54d1ca11d7f1","year":2022},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.097501Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:6f6fbcbdcaab776abbc8c3dba48c46d122289bd1588acff6a5eb86ce361ed7e0","observation_id":"5cdad6e7-b40d-43c5-9772-1a0f682d89e5","resolution":{"observed_at":"2026-08-07T10:56:36.546149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.530787Z","title":"Towards optimizing electrode configurations for silent speech recognition based on high-density surface electromyography,","venue":null,"work_id":"b6b36cf2-5a67-4e2b-84fb-a9dd93c29aa6","year":2021},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.101299Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:4999838106648f2c816401a6ddab03c7eaa8ab8a1a1f0302bd6e5f4420fe9d56","observation_id":"a33c6d63-228b-4ffe-b227-e510443ea0ee","resolution":{"observed_at":"2026-08-07T10:56:36.534577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.520444Z","title":"Silent speech interfaces: Non-invasive neuromuscular signal processing for assistive communication,","venue":null,"work_id":"a88d2196-9e56-4f24-ab42-d9b6725d9405","year":2025},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.106019Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:ce998f4429ac2d2ae5494756b2140937484b9d3a85a1826578352b0078405440","observation_id":"99f5a0f6-2130-4738-bba8-69e729ea04d0","resolution":{"observed_at":"2026-08-07T10:56:36.524116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.509512Z","title":"Ultrasound-and MRI-based speech synthesis applying neural networks,","venue":null,"work_id":"60e76a35-9e80-4963-9f3c-e6c119f182fc","year":2024},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.109891Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:21e132d6ffbb692eb3f9aeec4cc528675e15f92b98f0766a512ebfa439260446","observation_id":"e8126628-48a1-4d03-8db1-3f1862e123be","resolution":{"observed_at":"2026-08-07T10:56:36.513437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.498821Z","title":"Articulatory synthesis based on real-time magnetic resonance imaging data,","venue":null,"work_id":"b090e071-7ed7-4adf-ac9a-5177fb319a7d","year":2016},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.113941Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:5b512b51b523162c3264808c40d368258fb66f9edbad37abacfb5e6c70ee9e72","observation_id":"69b3688d-4b72-4e0f-8274-85c048ba4b73","resolution":{"observed_at":"2026-08-07T10:56:36.502548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.487162Z","title":"Silent versus modal multi-speaker speech recognition from ultrasound and video,","venue":null,"work_id":"4d7f0828-9ade-4154-a662-59544bf5334f","year":2021},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.117901Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:52db3e31ddda87821523f63b7063f90683147d2a348abb4254126858fc5a5b63","observation_id":"9505a2ff-d945-4033-b590-82cb7f09ecd8","resolution":{"observed_at":"2026-08-07T10:56:36.491795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.475141Z","title":"Melder: The design and evaluation of a real-time silent speech recognizer for mobile devices,","venue":null,"work_id":"224e10e0-d282-42e5-b65c-d754ec8bb0c1","year":2024},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.121262Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:3fd3e9d0dc398fadd18496b8eca75797267bb9c87a3f88445c43595e558e7bfa","observation_id":"58f988f0-10e1-464e-a9a3-6978d61fa414","resolution":{"observed_at":"2026-08-07T10:56:36.478749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.463449Z","title":"Statistical conversion of silent articulation into audible speech using full-covariance HMM,","venue":null,"work_id":"cc6a843b-8cf4-4afb-9f29-3800bd115f23","year":2016},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.125076Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:6c1843590e73b8faa1eae0c7d838af02496e97dce626d5d0cc27c6db180a94ca","observation_id":"364de235-6b99-4d51-9d95-8db0fe8f0bf0","resolution":{"observed_at":"2026-08-07T10:56:36.467326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.451811Z","title":"Multi-modal co-learning for silent speech recognition based on ultrasound tongue images,","venue":null,"work_id":"07c9a2f8-1c92-41ae-9681-40e25773d391","year":2024},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.128813Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:2b18d3e9ace7df3c184d8066043488f885299e763046e04d214fa66f24c21fd4","observation_id":"0a68c510-a4ea-4baf-920a-44b729d4c712","resolution":{"observed_at":"2026-08-07T10:56:36.455480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.439896Z","title":"DNN-based ultrasound-to-speech conversion for a silent speech interface,","venue":null,"work_id":"b8df9994-818c-44b4-bfa3-1f632f1488ac","year":2017},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.132657Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:408ea8abcaebba69a12b467c964c4865ec26d54b81d798d2da9940cd4f884d5a","observation_id":"148a7673-04a5-4a5f-b97b-8b65798a52eb","resolution":{"observed_at":"2026-08-07T10:56:36.443921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.428993Z","title":"Ultrasound-based silent speech interface using convolutional and recurrent neural networks,","venue":null,"work_id":"bda70e20-5e0c-4805-a0a6-b8c9d7043fa7","year":2019},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.136433Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:2fbc5debf223f6aec43867b44d8872a2c905c7e4de843a07e1415ccddd3ad1e3","observation_id":"9b0bcbb5-d443-4c24-92cc-80435b592397","resolution":{"observed_at":"2026-08-07T10:56:36.432734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.417509Z","title":"Ultra2speech – A deep learning framework for formant frequency estimation and tracking from ultrasound tongue images,","venue":null,"work_id":"2840ac28-6e41-4894-abb6-447d86ad2484","year":2020},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.139749Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:49ac3804716adc4ec140d8c1e08724a1ec8a43eafe35ed2273213db5d36ec274","observation_id":"0ce334f5-2d00-4213-b3c2-ea1b377d59d3","resolution":{"observed_at":"2026-08-07T10:56:36.421390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.407174Z","title":"SottoV oce: An ultrasound imaging-based silent speech interaction using deep neural networks,","venue":null,"work_id":"bc0d960a-1e80-4196-9fe5-4df8d9839992","year":2019},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.143330Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:15df152183155cc75b4ea57a9bf9b895743823bee7138a4c174f72e2ead971ff","observation_id":"8372e533-fd89-4bcc-8f51-e464ccce21b2","resolution":{"observed_at":"2026-08-07T10:56:36.410841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.393407Z","title":"Ultrasound-based articulatory-to-acoustic mapping with WaveGlow speech synthesis,","venue":null,"work_id":"ba9a9c96-c9d1-4730-9006-edfb36ac0dba","year":2020},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.147243Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:5325a7914a46b32453ed5903984efa1900a1126088b70687fcc0fa705f7fe852","observation_id":"75ea6984-67b4-4f2a-a686-c51181adb871","resolution":{"observed_at":"2026-08-07T10:56:36.400482Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.381777Z","title":"Attention is all you need,","venue":null,"work_id":"774dbed8-3f21-4a67-a075-35de0a706c33","year":2017},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.150634Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:9d19c89fdf6d8971bb9eeb60f076c75798fac737eed88372001a74b1a0843d98","observation_id":"4ace4bc6-3f98-4031-bdc4-d425271c3777","resolution":{"observed_at":"2026-08-07T10:56:36.385498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.368458Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":"6fffd571-e963-47f9-bfad-cbe636111234","year":2020},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.154233Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:5b52b9cb5aa302fba15cf00be7cadf669af21a6d0945771271d439dc30cb2383","observation_id":"2b6369a1-7cb2-4202-a9f3-3e72e70ada36","resolution":{"observed_at":"2026-08-07T10:56:36.373215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.354935Z","title":"Novel transformer networks for improved sequence labeling in genomics,","venue":null,"work_id":"0923dfe7-e386-4a05-9398-bd771ac8c8b5","year":2022},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.157766Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:8f503c34ec9e902fa2b0b344cc212284fe912ca3f81337d6d4467ddd1bdcaf13","observation_id":"c149615f-28e7-4d3a-ad7e-a4bcb9f781cd","resolution":{"observed_at":"2026-08-07T10:56:36.359796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.343263Z","title":"Streaming automatic speech recognition with the transformer model,","venue":null,"work_id":"7d43f6d9-d900-4586-8d5b-518c65617d00","year":2020},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.161321Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:8d9e0368215fc724e4bba4dd717d0e403b3fe2648d9bf9c32d5b9cfd46b4557c","observation_id":"22b95eff-838e-4b0f-ac37-21f9183d09cc","resolution":{"observed_at":"2026-08-07T10:56:36.347050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.331603Z","title":"Decoding silent speech from high-density surface electromyographic data using transformer,","venue":null,"work_id":"d0313a36-919f-49fd-81ef-19f5ce6d0775","year":2023},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.165093Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:6ea9f48be8ae44c21854084cac056a9942822a8c07369e6b790d41530c33c9f4","observation_id":"fde834b9-9bb3-4f1d-bf11-8dcae4e88f3d","resolution":{"observed_at":"2026-08-07T10:56:36.335586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.319183Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":"a9dba9c2-d022-4dbb-9607-f618c66cbc97","year":2020},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.168701Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:3301b95783ca31a45e5544db127cb47d8a94d9a305a17adf95c08ac8b2683d5f","observation_id":"25414eee-093a-4ce9-9fe4-582629ab727f","resolution":{"observed_at":"2026-08-07T10:56:36.323263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.307324Z","title":"Speech synthesis from three-axis accelerometer signals using conformer-based deep neural network,","venue":null,"work_id":"dba4efe8-259d-4e30-a073-a3d79b34e022","year":2024},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.172397Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:36dcd7f8ba599eb4229db138e3de7da89182241d6bd2a66a11563ede081d4ec4","observation_id":"26bd15bd-3658-4c85-af6b-5a8469b30575","resolution":{"observed_at":"2026-08-07T10:56:36.311310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.293978Z","title":"TaL: A synchronised multi-speaker corpus of ultrasound tongue imaging, audio, and lip videos,","venue":null,"work_id":"23bbed4e-be5c-448d-8d16-acfa49a811e3","year":2021},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.176010Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:a28aa1916bdbb5eb0f75d782e32311938b3b9283efefb0bceec45b4b120c9ca7","observation_id":"8309237b-d7e3-4d25-ae8f-4380259555cb","resolution":{"observed_at":"2026-08-07T10:56:36.298624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.280972Z","title":"HiFi-GAN: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":"a01a9d71-d252-4642-967a-72ebe8577447","year":2020},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.179642Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:7f05d61fdf67f137396e5276d8c679139416d7d5ddf776064cfa0f2b0911785e","observation_id":"da6108f4-9c1d-4b82-a814-24764b3d82a1","resolution":{"observed_at":"2026-08-07T10:56:36.285138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.268473Z","title":"Adaptation of tongue ultrasound-based silent speech interfaces using Spatial Transformer Networks,","venue":null,"work_id":"3efd6c17-3634-453f-be7d-d94a61567e93","year":2023},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.183597Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:b634df9e5f93bf646dd5f04c7257e36c2a692f1cd838da3f763cd7424707c152","observation_id":"38a05c13-a8b6-4c04-aa5d-eea686dd75ff","resolution":{"observed_at":"2026-08-07T10:56:36.273095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.255684Z","title":"On a test of whether one of two random variables is stochastically larger than the other,","venue":null,"work_id":"dc12ed7f-0a1a-41a2-acea-19408adf95fc","year":1947},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.187314Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:d9d486241298bc7d201d0539587560e1e83525b368291c195a762247c8c075c6","observation_id":"3ecf9ce9-bd96-493b-bac8-22c8aca8291d","resolution":{"observed_at":"2026-08-07T10:56:36.259701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:56:36.243137Z","title":"ITU-R Recommendation BS.1534: Method for the Subjective Assessment of Intermediate Audio Quality,","venue":null,"work_id":"49e02122-1ec9-46bc-bc4a-485fa1d59c47","year":2001},"citing_paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:56:36.190978Z"},"links":{"citing_paper":"/paper/2506.03831"},"observation_digest":"sha256:2ba4d20ebd21f4e75f800f243918ac378e89a07fe13e13e0a909549a45755ca2","observation_id":"e516cd63-d9ab-4e7c-aa17-3d7a0ca23e1c","resolution":{"observed_at":"2026-08-07T10:56:36.247341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.03831","last_updated":"2025-06-04T10:58:39Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T04:48:41.273707Z","submitted_at":"2025-06-04T10:58:39Z","title":"Conformer-based Ultrasound-to-Speech Conversion"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":2,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2506.03831."}