{"as_of":"2026-08-06T11:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:58ce1552d3b15e229674f7fb2ca7a0aa540814b04806ce528992470e8290761b","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T01:10:19.785888Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T17:52:39.050666Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T16:37:58.808519Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03937","snapshot_observed_at":"2026-08-05T17:52:39.050666Z","title":"Lcs-ctc: Leveraging soft alignments to enhance phonetic transcription robustness","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.16681","last_updated":"2025-08-21T15:01:05Z","snapshot_observed_at":"2026-08-05T17:52:36.987812Z","submitted_at":"2025-08-21T15:01:05Z","title":"Revisiting Rule-Based Stuttering Detection: A Comprehensive Analysis of Interpretable Models for Clinical Applications","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T17:52:39.050666Z"},"links":{"cited_paper":"/paper/2508.03937","citing_paper":"/paper/2508.16681"},"observation_digest":"sha256:d024f7b2db3d1536b7bec3bc85340bdef47efda2f5d14b38195d41741394b0f3","observation_id":"ce6bbf85-357e-401c-8469-e5d6819b7d53","resolution":{"observed_at":"2026-08-05T17:52:39.050666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"cited_work":{"arxiv_id":"2508.03937","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.03937","snapshot_observed_at":"2026-08-05T16:37:58.808519Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","venue":"eess.AS","work_id":"54cba1ff-24ba-441e-a355-10adedd6d42d","year":2025},"citing_paper":{"arxiv_id":"2509.00058","last_updated":"2025-08-25T14:23:09Z","snapshot_observed_at":"2026-08-05T16:37:57.114736Z","submitted_at":"2025-08-25T14:23:09Z","title":"A Comparative Study of Controllability, Explainability, and Performance in Dysfluency Detection Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T16:37:58.404792Z"},"links":{"cited_paper":"/paper/2508.03937","citing_paper":"/paper/2509.00058"},"observation_digest":"sha256:6b14dab6c494ace9205bc255863e3433b4d6ba1717780f7d66c156b5e666fb6d","observation_id":"6c4dd716-597c-4c50-9bf0-7123d5da3838","resolution":{"observed_at":"2026-08-05T16:37:58.904197Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.03937","snapshot_observed_at":"2026-08-04T11:06:49.960449Z","title":"Lcs-ctc: Leveraging soft alignments to enhance phonetic transcription robustness,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.07355","last_updated":"2026-05-28T11:55:17Z","snapshot_observed_at":"2026-08-06T09:38:42.371740Z","submitted_at":"2025-10-08T14:13:28Z","title":"AV-EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Omni-modal LLMS with Audio-visual Cues","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T11:06:49.960449Z"},"links":{"cited_paper":"/paper/2508.03937","citing_paper":"/paper/2510.07355"},"observation_digest":"sha256:bc6a0ecdc40d7fb73360b83f6d6e70eb2f529f7f12c254e4ba2eb270b2d8382a","observation_id":"6fab458a-3d21-45c4-9b3e-731303dd4d5f","resolution":{"observed_at":"2026-08-04T11:06:49.960449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.03937/citation-record","integrity":"/paper/2508.03937/integrity","json":"/paper/2508.03937/citation-record.json","paper":"/paper/2508.03937"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:15.574052Z","title":"Robust speech recognition via large-scale weak super- vision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:15.574052Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:adfd3113a1f5ff11cd0ccfc2170312a9ee4b3f3059cb6be17c4809a80c3e5397","observation_id":"679ba569-10a5-447d-8a94-62e11f3e2ec3","resolution":{"observed_at":"2026-08-06T01:10:15.574052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-04T01:36:29.191456Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-06T01:10:15.649692Z","title":"Google usm: Scaling automatic speech recognition beyond 100 languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:15.649692Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:6b70c7386b379eeaa3d6af9ead7b6a0cd37d2602d3c5ba9c0fbfc384e9d1206b","observation_id":"42b609ea-7c56-4341-b4fb-66f173c059f4","resolution":{"observed_at":"2026-08-06T01:10:15.649692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:15.762264Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:15.762264Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:9f984c60afcb40c176c0b9fef64165859f0578530181383e7f1b2ca8e62f31a2","observation_id":"1f2d45f1-0302-4565-b1e6-8692a29f1400","resolution":{"observed_at":"2026-08-06T01:10:15.762264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19674","last_updated":"2024-06-28T06:22:23Z","snapshot_observed_at":"2026-07-06T18:38:18.115901Z","submitted_at":"2024-06-28T06:22:23Z","title":"Less is More: Accurate Speech Recognition & Translation without Web-Scale Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19674","snapshot_observed_at":"2026-08-06T01:10:15.812317Z","title":"Less is more: Accurate speech recognition & translation without web- scale data,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:15.812317Z"},"links":{"cited_paper":"/paper/2406.19674","citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:96ccaef728806ffeefeeed1fd66e5542aef81d3cf249c6cd66e1bc5928b5847c","observation_id":"ee875b2f-4b94-4e81-95e7-236554a03d50","resolution":{"observed_at":"2026-08-06T01:10:15.812317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:26.817277Z","title":"Parakeet-rnnt-1.1b: A fastconformer transducer model for english asr,","venue":null,"work_id":"850aaaa3-84ef-460b-9ea7-c530131eb9a6","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:15.898087Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:1fa60b27c4dff6da3c7cac4f9bcbf996c44110cefdd395f44b9597debdd6ea8a","observation_id":"04983be9-70d6-4571-a825-4b9c85a12964","resolution":{"observed_at":"2026-08-06T01:10:26.919248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:26.582664Z","title":"Automatic pronunciation assessment - a review,","venue":null,"work_id":"d0cec668-e328-44c6-ae57-9d5eeca5e7fd","year":2023},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.028433Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:7a3cb174423a82eaf2268c2c35db3cc944d2aa6dde8e6b75f5bd425a8060748f","observation_id":"eb80cfe8-488c-4301-8384-a737d9102da0","resolution":{"observed_at":"2026-08-06T01:10:26.709412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:26.356642Z","title":"Automatic pronunci- ation error detection: an acoustic-phonetic approach,","venue":null,"work_id":"4e2f82ac-f5bb-489a-bc50-5443c1d4e7ea","year":2004},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.096474Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:21dd5de62fd41baacaa03cf347b4385defb3beabc1be6a472dc94412fa2bcb9d","observation_id":"1b0cdd1d-2f2f-46ae-8bdd-8bc4d2866701","resolution":{"observed_at":"2026-08-06T01:10:26.451931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:26.206086Z","title":"Language-independent methods for computer-assisted pronunciation training,","venue":null,"work_id":"acffba6c-1669-43aa-baf2-6b01d8f0981a","year":2016},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.205486Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:8cd1dc15178e46e9f38741a43b93c78ae26e4ba4510606f9062e36ba7c5807fa","observation_id":"ed74ab93-c029-4f6e-8a13-c8913b6f9845","resolution":{"observed_at":"2026-08-06T01:10:26.277081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:26.093690Z","title":"Connected speech fluency in poststroke and progressive aphasia: A scoping review of quantitative approaches and features,","venue":null,"work_id":"94c9a550-2f77-46d2-ac8e-4ce179293af2","year":2083},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.307247Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:10ee815e45bf1f3e5926449739120d156678c26fb73e50d2d68b25688569a5db","observation_id":"ff1525e5-1758-4dc0-8890-19d9c9d14717","resolution":{"observed_at":"2026-08-06T01:10:26.168038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:25.982224Z","title":"Automatically measuring speech fluency in people with apha- sia: First achievements using read-speech data,","venue":null,"work_id":"c0402d6a-e448-4004-89fb-ca37a7ab4e6c","year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.401726Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:13b58bd1a72a16039d7afa75b60c5c67b482d44f71940ebfec2381b20c33de1f","observation_id":"0828a8fd-1a9d-4ffa-aeda-80b13504529e","resolution":{"observed_at":"2026-08-06T01:10:26.022259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:25.839869Z","title":"The fluency dimension in aphasia,","venue":null,"work_id":"a96cf628-e4ea-4bbb-995a-293014eac953","year":1998},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.483649Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:1e0e33a2bf7c91d47cd364156b9895d5ace1d0a2bc27b867ad34566beebbf946","observation_id":"1d4ea09e-9dc9-4748-9652-002321101cac","resolution":{"observed_at":"2026-08-06T01:10:25.919630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:25.685879Z","title":"How do clinicians judge fluency in aphasia?","venue":null,"work_id":"a39be07b-f613-41f9-84dc-4b36f5e519f7","year":2022},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.554089Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:7abe853a2899524bc4ea08842107227dacdf499e950e369b143722aede7392d6","observation_id":"296f277c-649d-42a6-ba3f-d7f92d17f7ae","resolution":{"observed_at":"2026-08-06T01:10:25.762925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:25.488926Z","title":"Evaluating fluency in aphasia: Fluency scales, trichotomous judgements, or machine learning,","venue":null,"work_id":"ef4b26d2-1de0-4f80-8ae5-4ac92d3ef007","year":2023},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.670257Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:cc8072f6db9b1baa5fa0eb0787041c3d553b65572ed1bcf89ca720b0456a8d19","observation_id":"66545431-7090-4fd8-93cd-67c67ae5e720","resolution":{"observed_at":"2026-08-06T01:10:25.588927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:25.356421Z","title":"Ssdm: Scalable speech dysfluency modeling,","venue":null,"work_id":"e5e22351-8a2c-4b3f-89a6-70c11afc7683","year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.744039Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:48403ccd16f59814ab357d0359d297c5f45d48b8cc55a997f0a92f4e236b2e17","observation_id":"3082223f-c786-429f-896d-d97c93088e73","resolution":{"observed_at":"2026-08-06T01:10:25.428719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:25.243316Z","title":"Automatic detection of articulatory-based disfluencies in primary pro- gressive aphasia,","venue":null,"work_id":"64bb940a-494a-423d-b246-ff61c72798dc","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.829725Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:343b062560bcb389e3ee74194d2bf768cd8331361a5f2d1a51659a4fc712ca16","observation_id":"d6cf7cc5-9991-4818-876d-9e6e8d970045","resolution":{"observed_at":"2026-08-06T01:10:25.296040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:25.111434Z","title":"Yolo-stutter: End-to-end region-wise speech dysfluency detection,","venue":null,"work_id":"813d7fa2-4f77-4451-ba12-38022e7731d1","year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.910541Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:dccf005c2a897819d0b82478717e533342450881e771835aabbf9f986a2c4e64","observation_id":"beb534fa-69d4-408b-b58b-0d684a49d19d","resolution":{"observed_at":"2026-08-06T01:10:25.164124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:24.968415Z","title":"Stutter-solver: End-to- end multi-lingual dysfluency detection,","venue":null,"work_id":"49be9587-794d-4d9a-8994-018b1febec37","year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:16.992051Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:a46438bc580df32c33b2c6ab35a3bcf21191127ffa2a1084e61d5a91e3803488","observation_id":"32d1c7c5-4d0c-4578-84e4-668621604b4a","resolution":{"observed_at":"2026-08-06T01:10:25.029381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.13582","last_updated":"2024-09-20T15:35:32Z","snapshot_observed_at":"2026-08-06T11:21:01.875097Z","submitted_at":"2024-09-20T15:35:32Z","title":"Time and Tokens: Benchmarking End-to-End Speech Dysfluency Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.13582","snapshot_observed_at":"2026-08-06T01:10:17.070990Z","title":"Time and tokens: Benchmarking end- to-end speech dysfluency detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.070990Z"},"links":{"cited_paper":"/paper/2409.13582","citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:f4a6d73850c8cfda0dcc31d430469350d34d8a6145c4ab5ea2fb4140d668c7df","observation_id":"090d1eb9-a988-418a-81c4-99bd1c6ebb79","resolution":{"observed_at":"2026-08-06T01:10:17.070990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:24.821020Z","title":"Leveraging allophony in self-supervised speech models for atypical pronunciation assessment,","venue":null,"work_id":"3a784b33-42b4-493b-bb6a-f98521f6db4e","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.185655Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:8f9f83e29e08e50d579b2e5701d06418003d61b9a0f5c541b8bd961f34eece27","observation_id":"fdc2fc3b-9fac-4574-8f46-65d3484c68f5","resolution":{"observed_at":"2026-08-06T01:10:24.883509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:17.262966Z","title":"Connection- ist temporal classification: labelling unsegmented sequence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.262966Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:78b79cca050dc35717e7b512ef3faaea90cef1d2441c433668a83d375f09cd15","observation_id":"0bdf400a-128c-48d0-b037-0ffda75ace02","resolution":{"observed_at":"2026-08-06T01:10:17.262966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:24.640402Z","title":"Attention-based models for speech recognition,","venue":null,"work_id":"4a27f285-f3a7-4f25-a29c-64dad25d8b6d","year":2015},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.343686Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:41435a4fcbfdc9c792cd61b2c06954b1984b980a92b1a170695a3559728eea35","observation_id":"db49b142-491d-4ac9-b26d-098a39f9e720","resolution":{"observed_at":"2026-08-06T01:10:24.727979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.14849","last_updated":"2021-06-03T21:44:23Z","snapshot_observed_at":"2026-07-06T11:14:17.661344Z","submitted_at":"2021-05-31T10:03:14Z","title":"Why does CTC result in peaky behavior?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.14849","snapshot_observed_at":"2026-08-06T01:10:17.439103Z","title":"Why does ctc result in peaky behavior?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.439103Z"},"links":{"cited_paper":"/paper/2105.14849","citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:8a9ce7af2167c7593d9262f7478bab833065ed40648916ac3fa67e434e3bbccc","observation_id":"2f7838b4-0859-4786-b0b2-18a3dd9bdb10","resolution":{"observed_at":"2026-08-06T01:10:17.439103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:24.481316Z","title":"Careless whisper: Speech-to-text hallucination harms,","venue":null,"work_id":"aef1028f-0ff6-411a-a6c6-929f8b46b7a4","year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.550859Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:d0a7bca02b33322391856e127175f19304c7c661b35fa64cea7c89b4b75e37ce","observation_id":"76b58b45-db55-4ecc-ab85-47f888b154ee","resolution":{"observed_at":"2026-08-06T01:10:24.564969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:24.314455Z","title":"Bayes risk ctc: Controllable ctc alignment in sequence-to-sequence tasks,","venue":null,"work_id":"9cc606c5-2a0e-4909-be56-8a3f364cf670","year":2023},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.618670Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:6210c02bd8cc8fb36055c3d76ed1747012bd56198a9d6508cd58c312650a84f2","observation_id":"cd33eaee-6694-436c-8be9-77ef5b75b2f1","resolution":{"observed_at":"2026-08-06T01:10:24.416163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:24.111586Z","title":"Less peaky and more accu- rate ctc forced alignment by label priors,","venue":null,"work_id":"2a6be1dd-2554-4a60-91b2-5ae205116fad","year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.707488Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:003e3f54fa472a88f72218cc1f584d44cfed1e7cba0e36da1a443197aad3a482","observation_id":"3f774433-35b9-42ad-b501-8846b9bf9e67","resolution":{"observed_at":"2026-08-06T01:10:24.209456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:23.881709Z","title":"Cr-ctc: Consistency regularization on ctc for improved speech recognition,","venue":null,"work_id":"3f99aa62-b0ae-4e6b-894c-2da8ddd400b1","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.798955Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:040411d06554f4108859d7a31297f251f73997e940936b3aa2739f702b8e42cd","observation_id":"8f4a05fe-7e8e-49ee-bd00-842bce08b3b9","resolution":{"observed_at":"2026-08-06T01:10:23.954914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:23.663627Z","title":"Unconstrained dysfluency modeling for dysfluent speech transcription and detection,","venue":null,"work_id":"40b69304-a8b9-4f17-a9dc-29a19c6560f1","year":2023},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.874988Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:0a1a9fef227881f90227be1cccaaa5f7c34fdaf077c4b273737c1ad8961a023f","observation_id":"3ac49347-3d9d-40bd-80e2-d1abbcb61949","resolution":{"observed_at":"2026-08-06T01:10:23.758029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:23.470401Z","title":"Towards hierarchical spoken language disfluency modeling,","venue":null,"work_id":"f0350193-2773-4851-80bd-923f4fdf630e","year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:17.948721Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:062f0969206a038181d55df545a7b54adae42d9633d6c9908c4b5c6f7ca20173","observation_id":"e6e6fb0c-3326-465a-b300-ad45c3cd8936","resolution":{"observed_at":"2026-08-06T01:10:23.560997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:23.320644Z","title":"Seamless dysfluent speech text alignment for disordered speech analysis,","venue":null,"work_id":"89c8b5c3-86c1-4b88-baa9-b2c4a8fdf64c","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.028847Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:9a86e7fd5ce92ec634ea1ef8514fcf6e985b9c8d8240a40c42672ee22bfa4656","observation_id":"3bc452ad-d2a2-40fd-8732-74c16f639af9","resolution":{"observed_at":"2026-08-06T01:10:23.385824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:23.091767Z","title":"Algorithms for the longest common subsequence problem,","venue":null,"work_id":"88c8c27d-7d1c-4560-84a2-b24c18e442be","year":1977},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.113517Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:fcb0af8a4dee66997988928a22bcc3f3374c851240b1273bbdba08451411b415","observation_id":"0d81aacf-c301-453a-b36f-f5d3deac6da7","resolution":{"observed_at":"2026-08-06T01:10:23.191690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:22.885318Z","title":"Librispeech: An asr corpus based on public domain audio books,","venue":null,"work_id":"b2dbaeff-865c-43b8-a6e0-755ca60c7b25","year":2015},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.203891Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:2a6449d2bda7f70a250f6482e6bc5c809fd92dd39e76202fd0035908a6652d7c","observation_id":"12dacccc-5140-4c92-9bed-9084bfedb0b4","resolution":{"observed_at":"2026-08-06T01:10:22.976116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:22.749851Z","title":"Classification of primary progressive aphasia and its variants,","venue":null,"work_id":"52ae13d4-1a84-4bd9-9375-7feb0eede134","year":2011},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.299327Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:010bd0ddad5cbb6215d12457cbbfa8f9efff45165eba7bbc4d073dae49d77492","observation_id":"0e6291fe-1e70-410e-a502-773f7c4c4c07","resolution":{"observed_at":"2026-08-06T01:10:22.841668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:22.542539Z","title":"Analysis and evaluation of synthetic data gener- ation in speech dysfluency detection,","venue":null,"work_id":"dcc99b4e-81b6-41dc-9154-648ca367e815","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.382897Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:d951eda36bfc7705ecfa6ff163cd9fe150ca2bcddaf89489045db57a5e023b97","observation_id":"b8c0d377-b64f-4ad1-8c19-0129c315fac8","resolution":{"observed_at":"2026-08-06T01:10:22.634427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:22.386884Z","title":"Cstr vctk corpus: English multi-speaker corpus for cstr voice cloning toolkit (version 0.92),","venue":null,"work_id":"de5ee377-8cff-49b5-befe-ce6e7d533e7d","year":2019},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.478645Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:e5e929f3cb0b845c596dafc983dd1a6013b588d6f759c905c7b5a2f79f648208","observation_id":"8e36742c-c056-4320-97a5-fbf6b7d4c7b9","resolution":{"observed_at":"2026-08-06T01:10:22.424729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:22.231612Z","title":"Montreal forced aligner: Trainable text-speech alignment using kaldi,","venue":null,"work_id":"8ea6aa5e-7f55-4ecf-bb32-7f3b93e11f64","year":2017},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.534038Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:c382b1d73529035c6fc7224c9337a74500022e5006f8788a8537906f73b2c59f","observation_id":"1d821ea8-155b-4d29-a2f9-91fe6b0012d8","resolution":{"observed_at":"2026-08-06T01:10:22.287704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:18.617705Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.617705Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:2e03dced9388884ca6c6d4010f6fb0cc596b9acea65bb8c00a5def062d8e2b7a","observation_id":"6b9a0bc1-b891-433b-bea4-485a2c762373","resolution":{"observed_at":"2026-08-06T01:10:18.617705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:22.107525Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":"560d2fd1-16d2-4322-99df-76ce80b8ebb9","year":2020},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.708052Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:e6e436f00b3f3be2999a3c691cde3d3f441e3466020ad1ed62492f0832687dc9","observation_id":"3dd084cc-cc60-43d7-911b-8445a95158e8","resolution":{"observed_at":"2026-08-06T01:10:22.167381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:21.995734Z","title":"Model card addendum: Claude 3.5 haiku and upgraded claude 3.5 sonnet,","venue":null,"work_id":"27d1fa72-16ce-45d0-8623-3641769341d7","year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.809753Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:e9f55ef473f6b376ecd89a0dd09af9579fcd96f96d2d8e4cd531b86c5b577861","observation_id":"f68090d1-59ad-48aa-a331-245d88544fa5","resolution":{"observed_at":"2026-08-06T01:10:22.066091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:18.873566Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.873566Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:b971eecd25232bc379064a820750c2c0175a5e14462d62aa11f883efa7310fee","observation_id":"c05b835b-36ed-4295-a224-1be03343b87f","resolution":{"observed_at":"2026-08-06T01:10:18.873566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:21.855345Z","title":"Dysfluent wfst: A framework for zero-shot speech dysfluency transcription and detection,","venue":null,"work_id":"79c30134-b95a-48d7-9e5c-160e1d2a7b31","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:18.948864Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:c84b143c49cc7f412579cfea885f26a82306f57cd796eda94e9d431f91c2c994","observation_id":"71f713d6-f9b1-446d-97aa-4f0e244868d8","resolution":{"observed_at":"2026-08-06T01:10:21.888627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.34976","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:20.056317Z","title":"Coding speech through vocal tract kinematics,","venue":null,"work_id":"0c34f56b-4625-4f9e-b598-6b35aa991f57","year":2024},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.029155Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:00ad3a4e692034ece8856a5f530b2b3f3df49bd539a1f9aa7d4c55358bd0f45a","observation_id":"d75388d2-20d7-436d-b39a-2a0feb219d54","resolution":{"observed_at":"2026-08-06T01:10:20.116791Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:21.684281Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":"290cb5bf-fe0b-4cbc-afb1-0f7241e6da1b","year":2021},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.107922Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:0a60e99957ab8471360ffe48453ce29c3477328b6e2d7a9e4c60cbbbf7d0ad14","observation_id":"72478734-d9f7-443c-bfb8-7dfd55825128","resolution":{"observed_at":"2026-08-06T01:10:21.746606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:21.546926Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing,","venue":null,"work_id":"35679758-1503-4aa2-b3e9-2fe9be02f8ba","year":2022},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.178297Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:dcd91683b2844009b682ff71d1fb02b267bdb743851f07b26823dfd4ec3ebe8c","observation_id":"942f3e9c-1a6a-4449-a2dc-0f5ada61d59f","resolution":{"observed_at":"2026-08-06T01:10:21.633949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:21.375990Z","title":"Phone-to-audio alignment with- out text: A semi-supervised approach,","venue":null,"work_id":"7afc274f-807a-4cea-809c-37da853f4a83","year":2022},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.245759Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:2a670e7a47c3d5f8c5565633b903e79958d63387dde1c821e24efb11dedf0c6e","observation_id":"6c0a47a6-cdba-49dd-8715-712c2507eaf1","resolution":{"observed_at":"2026-08-06T01:10:21.471566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:21.124273Z","title":"Neufa: Neural network based end-to-end forced alignment with bidirectional attention mechanism,","venue":null,"work_id":"8c842789-c213-47d3-a028-5fa0eb998344","year":2022},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.302730Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:cd196a9b42cf549a97e93e70ace32def491ccbb2cce8afb01758f65f3596feec","observation_id":"d6a9b31c-4e73-4f65-b9d9-616e3bb1f1ba","resolution":{"observed_at":"2026-08-06T01:10:21.244350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:20.871579Z","title":"Joint speech and text machine translation for up to 100 languages,","venue":null,"work_id":"4c09f294-1d29-4d39-9f34-c10ba435fe1c","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.359340Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:51130cb9afeb001684697b97f52e6344af1e7c1ee0c9b54a397ae099b0b11469","observation_id":"3c537a3a-0853-4f17-852f-0859431c8f4f","resolution":{"observed_at":"2026-08-06T01:10:21.032963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:20.790761Z","title":"Towards accurate phonetic error detection through phoneme similarity modeling,","venue":null,"work_id":"e5f69009-70fd-4f8b-8788-d6bd840141e9","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.436216Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:6c7f65b7f618f9fd485c176d6effa4d81a084b56dcc22e87d539e36e40ae1e06","observation_id":"9385852b-cee6-4608-bf49-a234ecdfe3a4","resolution":{"observed_at":"2026-08-06T01:10:20.794891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:19.494279Z","title":"K-function: Joint pronunciation transcription and feedback for evaluating kids language function,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.494279Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:307d7aae158b28bc5e8d0fcbefdc0ac9bcd8636edc311dc7faec127528dcbc81","observation_id":"2ed74e90-54cc-4b32-9a84-38d5b7054465","resolution":{"observed_at":"2026-08-06T01:10:19.494279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:20.623580Z","title":"Coding speech through vocal tract kinematics,","venue":null,"work_id":"b2456da7-e05b-49cc-96a9-1c24e029fc35","year":2025},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.578688Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:189aabb03d4989282ce31559c80bacce156de4f4e8bbd0b02ae3641784b1dc42","observation_id":"b9e25f79-f85e-4e54-b16c-eb3c6b48f0a3","resolution":{"observed_at":"2026-08-06T01:10:20.702589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:20.424393Z","title":"Deep Neural Convolutive Matrix Factorization for Articulatory Representation Decomposition,","venue":null,"work_id":"89b2eb33-4c8c-4e10-a4ea-21509565fef4","year":2022},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.675382Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:ebff09da9b8e16f924f40fd429d1f1b755a7ebca050336e2bbab41f8ded65e3c","observation_id":"6e87ec0a-8479-40a7-8398-ac8f200373cf","resolution":{"observed_at":"2026-08-06T01:10:20.536939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T01:10:20.245848Z","title":"Articulatory representation learning via joint factor analysis and neural matrix factorization,","venue":null,"work_id":"665ab802-2bf7-4788-a777-32eefa73b97a","year":2023},"citing_paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T01:10:19.785888Z"},"links":{"citing_paper":"/paper/2508.03937"},"observation_digest":"sha256:262a14f65c26e07255a3aaa7324c81204b8019cdf03923a7b296bccbbb298696","observation_id":"6aac5fc0-1985-4f37-a48a-bbf03b5ab932","resolution":{"observed_at":"2026-08-06T01:10:20.333716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.03937","last_updated":"2025-08-13T18:58:04Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T01:10:15.255047Z","submitted_at":"2025-08-05T21:59:35Z","title":"LCS-CTC: Leveraging Soft Alignments to Enhance Phonetic Transcription Robustness"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":40},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 3 inbound Pith citation observations for arXiv:2508.03937."}