{"as_of":"2026-08-09T09:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c8e9e3880069c9ee5d95b9dfa5ffec345a74d18feeabe4fec1aa475c36502196","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:14:56.958112Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:14:55.982952Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T00:14:58.006095Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"cited_work":{"arxiv_id":"2608.00803","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.00803","snapshot_observed_at":"2026-08-05T00:14:58.006095Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","venue":"cs.SD","work_id":"bb996cc4-d4c0-4a13-bc5a-c35c639e7330","year":2026},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:55.982952Z"},"links":{"cited_paper":"/paper/2608.00803","citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:e4dfcb82f990bdc1fe74b7c5e173dc1942f0d6e9c1f74e855eac5726b4c431cd","observation_id":"cda6f7e0-ba7b-42ef-8d67-fa626956be11","resolution":{"observed_at":"2026-08-05T00:14:58.011543Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2608.00803/citation-record","integrity":"/paper/2608.00803/integrity","json":"/paper/2608.00803/citation-record.json","paper":"/paper/2608.00803"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.369098Z","title":null,"venue":null,"work_id":"6e9eb0c6-aa30-4461-a9f3-d7296675e368","year":null},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:55.945434Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:25f0c20f549ce5439194b0f595810bb49b910bc52f54c79247fa651423dd419c","observation_id":"daf1f164-06d5-4b5d-9245-1ebb1a32ba9c","resolution":{"observed_at":"2026-08-05T00:14:58.373859Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"cited_work":{"arxiv_id":"2608.00803","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.00803","snapshot_observed_at":"2026-08-05T00:14:58.006095Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","venue":"cs.SD","work_id":"bb996cc4-d4c0-4a13-bc5a-c35c639e7330","year":2026},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:55.982952Z"},"links":{"cited_paper":"/paper/2608.00803","citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:e4dfcb82f990bdc1fe74b7c5e173dc1942f0d6e9c1f74e855eac5726b4c431cd","observation_id":"cda6f7e0-ba7b-42ef-8d67-fa626956be11","resolution":{"observed_at":"2026-08-05T00:14:58.011543Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.352944Z","title":"I’ll”, “don’t","venue":null,"work_id":"5ffa7b58-ff2a-487b-9792-3faf971be678","year":1920},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.039161Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:29d4a9d689f0179d42cc4c2e776c952f5b282b869959fcbfd7eebed72cdf4877","observation_id":"f945fa8a-6d41-4bc0-85f3-5a6dbf5650d1","resolution":{"observed_at":"2026-08-05T00:14:58.358227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.336526Z","title":"Overview We build a baseline silent speech recognition system to facili- tate future research","venue":null,"work_id":"e436122d-5aeb-4f1b-8c7a-42df696455b2","year":null},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.076067Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:32b1fb8386d7ac6c4d178a5f4f4f565fb83329b0e7a91574182ca7ef6417279c","observation_id":"c47759ff-f1d8-46cd-ad6f-1ae6719711c4","resolution":{"observed_at":"2026-08-05T00:14:58.341552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.303945Z","title":"Main results Table 3 summarizes the performance for each configuration","venue":null,"work_id":"40a29ca4-7d60-4449-bbca-e50c4374d043","year":null},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.224314Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:fe5c601508147210fe63673079d130e778d22f92ca812418d80d51dfbf29828e","observation_id":"79d1761c-6e50-4e91-beba-9293004f0e1c","resolution":{"observed_at":"2026-08-05T00:14:58.309080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.285401Z","title":null,"venue":null,"work_id":"a6d2ad05-6862-45d9-a20e-29edc5a78e0e","year":null},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.267032Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:5a24a923e8185f80ca4d9b0be5e2eb6891a38af6f646aeeb376ae0e2e73be419","observation_id":"ce0f2c64-07a0-4b0c-834a-3caa3e4f1dde","resolution":{"observed_at":"2026-08-05T00:14:58.290829Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.267966Z","title":"The models used include: Gemini 3.0 Pro and Claude Opus 4.6","venue":null,"work_id":"9085cbef-3f8a-4a0b-8819-fae428ffe60a","year":null},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.347634Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:425b748dbccdce5b3ac11d42b06a7bdc230e880d61f0fd8b2f660527b491d894","observation_id":"a428f7de-275e-4a04-8edb-59c85e74c73c","resolution":{"observed_at":"2026-08-05T00:14:58.272904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.251807Z","title":null,"venue":null,"work_id":"978bbbfe-9e13-4011-b340-1f9c7e633474","year":null},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.406346Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:4746210bfba1f7fb075bc2c6c508e967056638f17b4425586479fa8f17c67a68","observation_id":"4894604a-256e-4803-a663-3dfe134169b7","resolution":{"observed_at":"2026-08-05T00:14:58.256659Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.159261Z","title":"An improved model for voicing silent speech,","venue":null,"work_id":"e094ddae-149d-46d3-8af1-c5dd0bf7bfd5","year":2021},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.837003Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:b8e346e04998f30d274155cddb46ab15d73880362b0e25d50e8fe09a9863e354","observation_id":"d78c158b-b9db-4be7-83f3-59a2e18de532","resolution":{"observed_at":"2026-08-05T00:14:58.163854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.235528Z","title":"SODA: Million-scale dialogue distillation with social commonsense contextualization,","venue":null,"work_id":"879e6b53-9185-4fb8-8056-c2434eb1b601","year":2023},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.485537Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:755397758dbd500135c735b9c4ce48fcf8ec20c9a67b823a56a92f2c2b2bbb07","observation_id":"dbde6b68-2899-4757-8c9d-3f91d4f45e67","resolution":{"observed_at":"2026-08-05T00:14:58.240408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.220520Z","title":"Silent speech interfaces,","venue":null,"work_id":"5ba753b1-a19f-436f-8627-88732b277ced","year":2010},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.564740Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:537310a4717bc50119d02a8ec7e1b5d0824ef72cb66af062f461dd9c620a8818","observation_id":"f411980f-d863-4c68-af80-6bfd4ee3c0ff","resolution":{"observed_at":"2026-08-05T00:14:58.225519Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"docview/2726946","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:57.975359Z","title":"V oicing silent speech,","venue":null,"work_id":"01d1d086-678b-4117-b417-5703182f06a0","year":2022},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.666786Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:c33194b06b8ebc44f1b844b1b2720b0641948b651e8428a683732d4fdca4d238","observation_id":"ffda7cc8-9667-44b6-9fc4-a7405fe16b4c","resolution":{"observed_at":"2026-08-05T00:14:57.982698Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.740964Z","title":"Echospeech: Continuous silent speech recognition on minimally-obtrusive eyewear powered by acoustic sensing,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.740964Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:2e81deb70136a0b42ce2a4f9ecc6fc6a3cbeb536d3686ec27be6a2a4eb8e9a91","observation_id":"658db5dc-9e76-4d11-840e-85041eef2c43","resolution":{"observed_at":"2026-08-05T00:14:56.740964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.204567Z","title":"Tal: A synchronised multi-speaker corpus of ultrasound tongue imaging, audio, and lip videos,","venue":null,"work_id":"4e9a5f2d-88f2-402e-a49f-389d68aaef0b","year":2021},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.819910Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:ed19772c5a806b9c5f96abbbe4b1223181d00a302219dc08fa5408924a4478f8","observation_id":"ec8cf37b-f4a8-4ca1-a51e-cfe009eb94e3","resolution":{"observed_at":"2026-08-05T00:14:58.209591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.320786Z","title":null,"venue":null,"work_id":"69beafe9-cc51-48c8-b9c6-5cb49f69bd9d","year":null},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.159563Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:fff39f0df900002f68f773f71403df7128097a4dd87fb0dfc05182853d4214c1","observation_id":"c28da4c7-57f5-4525-b09f-20763c948432","resolution":{"observed_at":"2026-08-05T00:14:58.325920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.189174Z","title":"The lj speech dataset,","venue":null,"work_id":"1e6d0a81-19aa-40d2-8273-02536f1e14d3","year":2017},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.828531Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:4f036ccaa2d52a1db34f4c47e2b8715a57bcfc4b0e2f430893b12432966e9581","observation_id":"45b445f4-204b-44e2-957f-5896579191cb","resolution":{"observed_at":"2026-08-05T00:14:58.193618Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.174007Z","title":"Digital voicing of silent speech,","venue":null,"work_id":"29452029-dd01-44bf-a8fc-8a2ae0d3372b","year":2020},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.832781Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:df599cc3231fca0a9283c8f696ec8d492d7f7fc8951d60fc33d5970aebb3b134","observation_id":"4a260a54-9cfc-485a-adc3-ae76d4898dd9","resolution":{"observed_at":"2026-08-05T00:14:58.178659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3534621","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Eario: A low-power acoustic sensing earable for continuously tracking detailed facial movements,","venue":"Proceedings of the ACM on Interactive Mobile Wearable and Ubiquitous Technologies","work_id":"cc78e2dc-c1f1-4969-8167-23100c9361ad","year":2022},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.886958Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:dbe0c49f3e6c0300514fc45011900db3905da2d1762a387cbc51045a32495e40","observation_id":"3196a196-66f1-49a3-ab91-76b668dc9216","resolution":{"observed_at":"2026-08-05T00:14:57.083070Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-07T00:38:21.02627+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T00:38:21.02627+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.127388Z","title":"SSR7000: A synchronized corpus of ultrasound tongue imaging for end-to-end silent speech recognition,","venue":null,"work_id":"91042db2-944b-46a1-910e-0090f789556a","year":2022},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.845517Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:0cc998476758204e2127de28a7fe0372ab13bd9091993e73b10a676f3d1180f4","observation_id":"9bcd3db0-1e06-40c3-8d7b-a5a99e53b8c1","resolution":{"observed_at":"2026-08-05T00:14:58.131994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07595","last_updated":"2024-07-10T12:29:01Z","snapshot_observed_at":"2026-08-09T06:58:21.605558Z","submitted_at":"2024-07-10T12:29:01Z","title":"Scaling Law in Neural Data: Non-Invasive Speech Decoding with 175 Hours of EEG Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07595","snapshot_observed_at":"2026-08-05T00:14:56.849892Z","title":"Scaling law in neural data: Non-invasive speech decoding with 175 hours of eeg data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.849892Z"},"links":{"cited_paper":"/paper/2407.07595","citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:6ac0bc824b96cd51dd439401d39cc2b27d34613ae14e53df78f1bf385b96db73","observation_id":"23ca52cb-293a-4815-9445-695af9950a1c","resolution":{"observed_at":"2026-08-05T00:14:56.849892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05583","last_updated":"2024-03-02T21:15:24Z","snapshot_observed_at":"2026-08-03T07:37:38.592143Z","submitted_at":"2024-03-02T21:15:24Z","title":"A Cross-Modal Approach to Silent Speech with LLM-Enhanced Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05583","snapshot_observed_at":"2026-08-05T00:14:56.854796Z","title":"A cross-modal approach to silent speech with llm-enhanced recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.854796Z"},"links":{"cited_paper":"/paper/2403.05583","citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:fc6f8831ba39bab83bb958682c8dc8a4249bcf61e110ea40014dee1736556e5f","observation_id":"54a006ba-5e73-4268-b474-44ad950932f0","resolution":{"observed_at":"2026-08-05T00:14:56.854796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3494987","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Speechin: A smart necklace for silent speech recognition,","venue":"Proceedings of the ACM on Interactive Mobile Wearable and Ubiquitous Technologies","work_id":"e7a93464-ef5a-4419-a8db-d0805a67281a","year":2022},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.859637Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:f649d9b48dde1833d7dd62c9fcebb93fe0488433c8746548e0fd3d3c11e5394d","observation_id":"4a91a7af-31af-4e1e-a281-d6369b7b15ea","resolution":{"observed_at":"2026-08-05T00:14:57.111469Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-07T00:38:21.229136+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T00:38:21.229136+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.110718Z","title":"A data-efficient and easy-to-use lip language interface based on wearable motion capture and speech movement reconstruction,","venue":null,"work_id":"41a16d57-697a-45d4-817a-3bbfdcbe274b","year":2024},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.864185Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:b783b60564a73055fe51443f13eb211e1ffe350edace415e8006003056794330","observation_id":"e99f066d-a3c1-4ce8-a55c-2010ce538a8a","resolution":{"observed_at":"2026-08-05T00:14:58.116276Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4738.36113","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:57.680538Z","title":"Hpspeech: Silent speech interface for commodity headphones,","venue":null,"work_id":"338ef448-f0ec-4859-a7ea-529a3e9a8ac5","year":2023},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.868151Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:5cb3740346f500aef2c91b3826b9eff1eed39409215347b041444f6f291766df","observation_id":"2df013ee-de42-4b2c-a192-81d65f2657af","resolution":{"observed_at":"2026-08-05T00:14:57.689062Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.872479Z","title":"Earcommand:","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.872479Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:e5afe3b2dffe2d8073dc4fa394bd3636a6e7f636737c866c47f17057c9691b77","observation_id":"9095ed43-6461-4b00-8165-8d81df4029c9","resolution":{"observed_at":"2026-08-05T00:14:56.872479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.877118Z","title":"Rehearsse: Recognizing hidden-in-the-ear silently spelled expressions,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.877118Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:df1fb08d017e2c428e667efe128611f9f5a18a1bdd53be03203a8a0153ee509e","observation_id":"988da8f7-5b48-4aac-8cce-288f0c64d798","resolution":{"observed_at":"2026-08-05T00:14:56.877118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.095336Z","title":"Novel three-axis accelerometer-based silent speech in- terface using deep neural network,","venue":null,"work_id":"29dab58b-4cf3-4751-b3f3-c848d76fe035","year":2023},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.881822Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:41a24f78b55a7b6b6f047983f95b5571f825e1bd996ec11af325ed30c236d179","observation_id":"24513e4f-09bf-40f2-a2d6-b6fcb244d918","resolution":{"observed_at":"2026-08-05T00:14:58.100087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.933871Z","title":"Spellring: Recognizing continuous fingerspelling in american sign language using a ring,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.933871Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:123d14ed4f8fc9d1e6e0487ea7979e60ff63c30f704b277ad017e6074067c15a","observation_id":"06a98ebd-4f8c-4f75-8c35-2dc9402c6ff8","resolution":{"observed_at":"2026-08-05T00:14:56.933871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.891243Z","title":"Eyeecho: Continuous and low-power facial expression tracking on glasses,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.891243Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:25516f0fb654f9a94793baa2a1586f7b27da18d80224142a1eac50c89bde54f2","observation_id":"78d0a4a6-3352-40a7-a74a-203544f76d30","resolution":{"observed_at":"2026-08-05T00:14:56.891243Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1121/1.2229005","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An audio-visual corpus for speech perception and automatic speech recognition,","venue":"The Journal of the Acoustical Society of America","work_id":"2d1b66b4-e88b-4aa0-96fc-efd77a644583","year":2006},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.895364Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:23008bc2a5b94c568fa05d61db2c7e21e5d962f2769d12ef56abe6d59cbf3f10","observation_id":"e9991909-2918-4e47-9474-8881c8ec69cc","resolution":{"observed_at":"2026-08-05T00:14:57.065960Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-07T00:38:21.688436+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T00:38:21.688436+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.079316Z","title":"Speech rate and pausing in english: Comparing learners at different levels of proficiency with native speakers","venue":null,"work_id":"39f6a575-1f89-4cdf-9929-a191f82176f0","year":2020},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.899594Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:ed1dab053c8aab9632fef93f2930475b4de6260e21060ef2f2e236a3809e6db0","observation_id":"d7830578-0bf3-49b8-b992-d8252cf2500b","resolution":{"observed_at":"2026-08-05T00:14:58.084543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.063300Z","title":"Average speaking rate and words per minute,","venue":null,"work_id":"1e840ede-2e02-4af9-8282-f61133a405f9","year":2022},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.905053Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:01938eb97f76b1654e50512d9cd4af46bbc34d26cd3c223101cb1d73ed66b2cc","observation_id":"c5c48e97-6bac-4c79-8437-5ad5871b0d14","resolution":{"observed_at":"2026-08-05T00:14:58.067824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.047645Z","title":"Sonicid: User identification on smart glasses with acoustic sensing,","venue":null,"work_id":"51cf23dc-3e5b-4240-a6fc-0b5380daa2d9","year":null},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.908961Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:eee7e9d2c40ca94697c3fbd0af9eacb91ae7369db67e4250f4a8860112c0e3a2","observation_id":"7261966d-11e1-430d-bd68-fb3059d368ea","resolution":{"observed_at":"2026-08-05T00:14:58.052238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.958112Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.958112Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:99a3c1e5e8f0d4be12e4722ba040a729af2ab27cfe086f786ec2a6ba0ce8eacd","observation_id":"ea8a2d1c-aa33-40c1-8509-0bfcd5a9544e","resolution":{"observed_at":"2026-08-05T00:14:56.958112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.917280Z","title":"Echoforce: Continuous grip force estimation from skin deformation using active acoustic sensing on a wristband,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.917280Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:c86b95391e518d8d808899a202eb88143c0a0108e721a04e283875872b2fde95","observation_id":"2ac0e14b-4654-4f8a-90ff-51f053cc90af","resolution":{"observed_at":"2026-08-05T00:14:56.917280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3699741","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ring-a-pose: A ring for continuous hand pose tracking,","venue":"Proceedings of the ACM on Interactive Mobile Wearable and Ubiquitous Technologies","work_id":"ccebf886-ae65-4162-a145-c0f187b9f443","year":2024},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.921816Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:318fbebabf509fb9f9c79dc1b6f26faccc04ff9bd19706a94bc4c2589a30abcc","observation_id":"d1b1cab7-a9be-415b-9e76-6e2fd3ca24b9","resolution":{"observed_at":"2026-08-05T00:14:57.033923Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-07T00:38:22.252651+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T00:38:22.252651+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:57.438356Z","title":"Echowrist: Continuous hand pose tracking and hand-object interaction recognition using low-power active acoustic sensing on a wristband,","venue":null,"work_id":"855fc6bc-89d0-4b41-81eb-b9c640a3f32b","year":2024},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.925728Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:e524dca9b8a6585381965e7b8162eea84378a0aebd72165eca78d43bf53f89cb","observation_id":"322ac464-5509-4281-be45-865dcae5e9fd","resolution":{"observed_at":"2026-08-05T00:14:57.444593Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2318.37909","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:57.382538Z","title":"Watchhand: Enabling continuous hand pose tracking on off-the-shelf smartwatches,","venue":null,"work_id":"a6d7a9a6-e5fe-47cd-9d53-df59cbdb35bf","year":2026},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.929643Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:c6a911fa412cc92e124f4cb96099ca5810eb807f2d16c4712e2c33454c59c17f","observation_id":"b16361ca-5069-4b88-be80-2f8dcc01ad2e","resolution":{"observed_at":"2026-08-05T00:14:57.391974Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.937730Z","title":"Actsonic: Recognizing everyday activities from inaudible acoustic wave around the body,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.937730Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:5328f96bb82ed60051a8005b8d59feb5a3cb10beda078b359ef871726734f80b","observation_id":"e332d78b-8a3e-46b4-99e9-481867b4166f","resolution":{"observed_at":"2026-08-05T00:14:56.937730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.941759Z","title":"Munchsonic: Tracking fine- grained dietary actions through active acoustic sensing on eyeglasses,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.941759Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:b5d9aca48453f63d664202912746aca6386d1534d91ac8f2092a1de0d8990511","observation_id":"f97b23b5-8ee5-4ea9-ad7e-b64ebf5b3e19","resolution":{"observed_at":"2026-08-05T00:14:56.941759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.946015Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.946015Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:b16d93cde3173afa891f4720c06db516fa8d997f3ce0fa00a7a73078f1f3b482","observation_id":"c42c3f20-2c90-4a95-bbb7-0d766e1bb9e7","resolution":{"observed_at":"2026-08-05T00:14:56.946015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.949982Z","title":"SentencePiece: A simple and language independent subword tokenizer and detokenizer for neural text processing,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.949982Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:1a9155cdc0a98b79af66c32f371aa5ece8139c257fa97f5a9ba57d9d19fff224","observation_id":"e038e481-d985-4f52-a95f-609d94784f34","resolution":{"observed_at":"2026-08-05T00:14:56.949982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:56.954167Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.954167Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:e24efcf0618aa235a6e78a1592964808d0b9876202777d4df4e475f015f9c905","observation_id":"2fd3d4fd-c8b2-464b-acf8-916ddeada6d5","resolution":{"observed_at":"2026-08-05T00:14:56.954167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:14:58.142473Z","title":"Available: https://aclanthology.org/2021.acl-short","venue":null,"work_id":"918b5193-cae4-488b-88eb-63ecbd350356","year":2021},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":181,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.841470Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:368be2f3a2377cbc1dbce41e47b65f0a2366436af15dda571cecdc18c48d2083","observation_id":"4c2cba6b-91dc-4ec9-9ea3-dad13a041640","resolution":{"observed_at":"2026-08-05T00:14:58.147682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3699734","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Available: https://doi.org/10.1145/3699734","venue":"Proceedings of the ACM on Interactive Mobile Wearable and Ubiquitous Technologies","work_id":"c903841c-8741-4b40-9494-3c4dd23ecb33","year":null},"citing_paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T00:14:56.913020Z"},"links":{"citing_paper":"/paper/2608.00803"},"observation_digest":"sha256:d5a919cd6366d88cbc5d3b45bc42b3e549febd8199f80687a9fec94c46d0caf9","observation_id":"2e704172-8939-4408-8972-e5e9a15f69f6","resolution":{"observed_at":"2026-08-05T00:14:57.049326Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-07T00:38:23.028736+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T00:38:23.028736+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00803","last_updated":"2026-08-01T18:03:37Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T07:20:47.415301Z","submitted_at":"2026-08-01T18:03:37Z","title":"SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":2,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":17,"verified_exact":8,"verified_fuzzy":16},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2608.00803."}